AI 自動剪片小幫手

我怎麼把一次次退稿,變成 AI 下次不能跳過的規則

夏日層次襯衫的十支原始素材
回到「兩人公司,如何打造 15 位 AI 員工」
我是 Kim
經營一個兩人服飾品牌。
沒有工程師,也沒有剪輯團隊。
每次拍完影片
真正花時間的,才正要開始。
一支 Reel 的後面
不是只有把片段接起來。
挑鏡頭
排口白
上字幕
做特效
調音量
所以我想要一位
可以看素材、挑鏡頭,
直接把草稿排進 CapCut 的
AI 剪片小幫手。
一開始,我想得很簡單
素材丟進去,影片就剪出來。
它真的剪出來了。
可是,不能用。
01
它會處理影片
但它還不會看影片
第一版
用程式偵測畫面變化、自動分段,
再直接輸出影片。
我看完只說
「剪得很一般。」
「不知道在剪什麼。」
程式看到的,跟我看到的不一樣
程式看到的
清不清楚
有沒有動
我看到的
哪個動作有細節
哪個鏡頭適合收尾
所以第二步
先讓 AI 真的看見素材。
我把影片攤開來給它看
影片抽格
拼成縮圖聯絡表
逐格看畫面
挑選鏡頭
這次,它不只知道影片存在
它能說出撥領口是細節、
側走有節奏、背影適合收尾。
接著,我要求它
不要只輸出一支不能修改的影片,
直接交付 CapCut 可編輯草稿。
第一次又失敗了
草稿看得到素材,
時間軸卻載不進去。
問題不在素材
是 AI 產生的草稿格式,跟我電腦上的 CapCut 版本對不上。
AI 從零猜格式
看起來很像
打開卻少了幾樣 CapCut 一定要的東西
CapCut 真實草稿格式
我電腦上那一份
它一定是對的,因為它跑得起來
那段時間,我還問過它
「難道只有我在找方法。」
後來真正的突破
不是再找一個新工具,
而是請 AI 拆解我自己存出的真實草稿。
不再從零猜
我做一份小範本
AI 拆解真草稿
保留合法結構
只替換素材與時間
先有一份真的好看過的母版
字型、色彩、字幕位置與節奏,
都不必每次重新猜。
早上已驗證的 BOXY 素 T 母版聯絡表
能打開,只是第一關。
02
真正的考試
夏日層次襯衫
10
支素材
AI 的第一件事,
不是剪,是全部看完。
夏日層次襯衫十支原始素材
完整,不是全部都用
第一版做的事
10 支全部塞進去
重講、停頓與語意重複也一起剪進片子
最後的版本
採用 8 支,主動淘汰 2 支
被淘汰的兩支素材
04 同一段重講兩次「還有厲害的地方」
06 「製造層次感」跟下一句語意重複
有重講、有停頓,也有語意重複
沒完成口白校稿以前,
畫面排得再漂亮都沒有用。
先把話剪順
全部聽完
標出重講與重複
淘汰 2 支
排出純口白
再加畫面
20.64
最後採用 8 支素材,
排成 10 段主線與 2 段補充畫面。
這是最後的 CapCut 時間軸
18 條字幕、完整人聲、音樂與音效,都留在可繼續修改的草稿裡。
最終 CapCut 草稿與時間軸
技術上有產出
不等於品牌可以使用。
03
我一項一項退
AI 一項一項記
第一個問題,是字型
AI 第一版
領口是小立領的感覺
圓體、宋體、綜藝體混用,有些字太細
缺繁中字的時候,CapCut 會自己換一套字補上,同一句就出現兩種字形
最後規則
領口是小立領的感覺
完整繁中粗體,不用細字
缺一個字,整套字型退件
第二個問題,是顏色
顏色越多,不代表畫面越有層次。
中間版本
很有設計
黃色、藍色、不同色塊,一頁一個樣
最後只留兩個
穿起來很輕薄
很有設計感
一般口白白色,重點花字淡黃色,淺色字一律加黑色承托
第三個問題,是換行
我一直問:「這麼短為什麼要三行」。最後 18 條字幕全部單行,手動換行 0。
三句改成單行後的實機畫面
第四個問題,是字幕放哪裡
抽繩示範畫格
穿起來很輕薄
又很有質感
下擺的抽繩直接綁起來
IG 介面會蓋住
每句都套同一個位置
正在示範的抽繩被字蓋住
抽繩示範畫格
穿起來很輕薄
又很有質感
下擺的抽繩直接綁起來
IG 介面會蓋住
避開臉、手勢與正在介紹的商品細節
字往上移,抽繩整段看得到
第五個問題,是動了卻看不懂
「這件跟你想的不一樣!」原本從側邊滑入,最後改成中央彈跳,一眼就知道這句是重點。
這句話的原始畫格這件跟你想的不一樣!
原本:從側邊滑入
看不出來字從哪裡進來
這句話的原始畫格這件跟你想的不一樣!
最後:中央彈跳
0.55 倍 → 1.14 倍 → 1.0 倍
花字在 CapCut 的實際畫面
實機畫面
CapCut 播放時的樣子
第六個問題,是字幕看起來有同步
實際播放時,第一個字卻比人聲晚出現。
AI 原本的驗收方式
只看字幕片段何時開始
檔案裡寫著同一秒,就當成對到了
最後的驗收方式
驗收第一個字真正出現的時間
字幕約在人聲前 0.05 秒出現,有進場動畫就再往前挪
差 2 dB,就要處理
不能只調整整條人聲,還要逐句比較相鄰音量。
前句
-18.6 dBFS
沒錯
-17.8 dBFS
很有設計感
-19.5 dBFS
後句
-18.7 dBFS
人聲軌、音樂軌與音效軌
9 道 gate
開始剪以前
01素材口白表完成前,不准開始剪
02先剪順純口白,再加畫面、字幕與特效
03直接沿用已驗證母版,不從零猜風格
04字幕預設單行
05依第一個字實際可見時間同步口白
交付以前
06每句檢查字型、字寬、安全區、遮臉與裁切
07人聲逐句量測,音樂與音效讓位
08備份後只更新同一份 CapCut 草稿
09在 CapCut 完整播放後才可交付
現在的自動剪片流程
看完素材
剪順口白
套用母版
通過九道 gate
CapCut 完整播放
我沒有把審美交給 AI
我做的
人決定什麼好看
AI 做的
記住
量測
重建
重複驗證
AI 不必替我決定什麼好看。
它真正有價值的地方,
是讓我教過一次的事,下次不用再教一次。
謝謝大家 Q&A
方向鍵或空白鍵切換.F 全螢幕