AI 自動剪片小幫手
我怎麼把一次次退稿,變成 AI 下次不能跳過的規則
Kim
âme soeur 共同創辦人
回到「兩人公司,如何打造 15 位 AI 員工」
我是 Kim
經營一個兩人服飾品牌。
沒有工程師,也沒有剪輯團隊。
每次拍完影片
真正花時間的,才正要開始。
一支 Reel 的後面
不是只有把片段接起來。
挑鏡頭
排口白
上字幕
做特效
調音量
所以我想要一位
可以看素材、挑鏡頭,
直接把草稿排進 CapCut 的
AI 剪片小幫手。
一開始,我想得很簡單
素材丟進去,影片就剪出來。
它真的剪出來了。
可是,不能用。
01
它會處理影片
但它還不會看影片
第一版
用程式偵測畫面變化、自動分段,
再直接輸出影片。
我看完只說
「剪得很一般。」
「不知道在剪什麼。」
程式看到的,跟我看到的不一樣
程式看到的
清不清楚
有沒有動
我看到的
哪個動作有細節
哪個鏡頭適合收尾
所以第二步
先讓 AI 真的看見素材。
我把影片攤開來給它看
影片抽格
→
拼成縮圖聯絡表
→
逐格看畫面
→
挑選鏡頭
這次,它不只知道影片存在
它能說出撥領口是細節、
側走有節奏、背影適合收尾。
接著,我要求它
不要只輸出一支不能修改的影片,
直接交付 CapCut 可編輯草稿。
第一次又失敗了
草稿看得到素材,
時間軸卻載不進去。
問題不在素材
是 AI 產生的草稿格式,跟我電腦上的 CapCut 版本對不上。
AI 從零猜格式
看起來很像
打開卻少了幾樣 CapCut 一定要的東西
CapCut 真實草稿格式
我電腦上那一份
它一定是對的,因為它跑得起來
那段時間,我還問過它
「難道只有我在找方法。」
後來真正的突破
不是再找一個新工具,
而是請 AI 拆解我自己存出的真實草稿。
不再從零猜
我做一份小範本
→
AI 拆解真草稿
→
保留合法結構
→
只替換素材與時間
先有一份真的好看過的母版
字型、色彩、字幕位置與節奏,
都不必每次重新猜。
能打開,只是第一關。
02
真正的考試
夏日層次襯衫
10
支素材
AI 的第一件事,
不是剪,是全部看完。
完整,不是全部都用
第一版做的事
10 支全部塞進去
重講、停頓與語意重複也一起剪進片子
最後的版本
採用 8 支,主動淘汰 2 支
04
同一段重講兩次「還有厲害的地方」
06
「製造層次感」跟下一句語意重複
有重講、有停頓,也有語意重複
沒完成口白校稿以前,
畫面排得再漂亮都沒有用。
先把話剪順
全部聽完
→
標出重講與重複
→
淘汰 2 支
→
排出純口白
→
再加畫面
20.64
秒
最後採用 8 支素材,
排成 10 段主線與 2 段補充畫面。
這是最後的 CapCut 時間軸
18 條字幕、完整人聲、音樂與音效,都留在可繼續修改的草稿裡。
技術上有產出
不等於品牌可以使用。
03
我一項一項退
AI 一項一項記
第一個問題,是字型
AI 第一版
領口是
小立領
的感覺
圓體、宋體、綜藝體混用,有些字太細
缺繁中字的時候,CapCut 會自己換一套字補上,同一句就出現兩種字形
最後規則
領口是小立領的感覺
完整繁中粗體,不用細字
缺一個字,整套字型退件
第二個問題,是顏色
顏色越多,不代表畫面越有層次。
中間版本
很有
設計
感
黃色、藍色、不同色塊,一頁一個樣
最後只留兩個
穿起來很輕薄
很有設計感
一般口白白色,重點花字淡黃色,淺色字一律加黑色承托
第三個問題,是換行
我一直問:「這麼短為什麼要三行」。最後 18 條字幕全部單行,手動換行 0。
第四個問題,是字幕放哪裡
穿起來很輕薄
又很有質感
下擺的抽繩直接綁起來
IG 介面會蓋住
每句都套同一個位置
正在示範的抽繩被字蓋住
穿起來很輕薄
又很有質感
下擺的抽繩直接綁起來
IG 介面會蓋住
避開臉、手勢與正在介紹的商品細節
字往上移,抽繩整段看得到
第五個問題,是動了卻看不懂
「這件跟你想的不一樣!」原本從側邊滑入,最後改成中央彈跳,一眼就知道這句是重點。
這件跟你想的不一樣!
原本:從側邊滑入
看不出來字從哪裡進來
這件跟你想的不一樣!
最後:中央彈跳
0.55 倍 → 1.14 倍 → 1.0 倍
實機畫面
CapCut 播放時的樣子
第六個問題,是字幕看起來有同步
實際播放時,第一個字卻比人聲晚出現。
AI 原本的驗收方式
只看字幕片段何時開始
檔案裡寫著同一秒,就當成對到了
最後的驗收方式
驗收第一個字真正出現的時間
字幕約在人聲前 0.05 秒出現,有進場動畫就再往前挪
差 2 dB,就要處理
不能只調整整條人聲,還要逐句比較相鄰音量。
前句
-18.6 dBFS
沒錯
-17.8 dBFS
很有設計感
-19.5 dBFS
後句
-18.7 dBFS
9 道 gate
每一次退稿,最後都要變成下一次不能跳過的檢查。
開始剪以前
01
素材口白表完成前,不准開始剪
02
先剪順純口白,再加畫面、字幕與特效
03
直接沿用已驗證母版,不從零猜風格
04
字幕預設單行
05
依第一個字實際可見時間同步口白
交付以前
06
每句檢查字型、字寬、安全區、遮臉與裁切
07
人聲逐句量測,音樂與音效讓位
08
備份後只更新同一份 CapCut 草稿
09
在 CapCut 完整播放後才可交付
現在的自動剪片流程
看完素材
→
剪順口白
→
套用母版
→
通過九道 gate
→
CapCut 完整播放
我沒有把審美交給 AI
我做的
人決定什麼好看
AI 做的
記住
量測
重建
重複驗證
AI 不必替我決定什麼好看。
它真正有價值的地方,
是讓我教過一次的事,下次不用再教一次。
謝謝大家 Q&A
‹
01 / 45
›
方向鍵或空白鍵切換.F 全螢幕