
配音最容易翻車的,不是音色「不夠像人」,而是把字幕匯出到另一個軟體再合成:軸丟了,口型對不上,改一句就要整段重錄。處理台裡更穩的做法是:先把字幕審完,再按同一條時間軸逐段合成。配音作為額外音軌寫入,預設可留著原聲。
先有乾淨的軸,再合成
沒有時間戳的文案,模型只能從頭念到尾,長短全靠猜。正確順序:
- 先出帶起迄點的字幕(聽寫、硬字幕或匯入 SRT)。
- 審校錯字、人名和氣口,再開配音。
- 合成只讀目前軸上的文字,不另開工程。
十分鐘字幕路徑見這篇教學。軸亂了再配,只會把錯誤放大。
同一條軸上的配音路徑
- 打開處理台,用既有工程或拖入本機 MP4 / MOV。素材留在瀏覽器裡。
- 確認字幕軸已審過。還沒有軸時,可先辨識或匯入 SRT。
- 勾選「AI 配音」。中文選曉晴;英文從多種音色裡挑。自動偵測時,中文段落用曉晴,英文段落用你選的英文音色。
- 預設語速貼合每條字幕時長。某一句被拉得又尖又快,先改那條的字數或起迄點,不要整片手動拉到 1.4 倍。
- 預設勾選「保留原聲」。配音寫入額外音軌,畫面仍跟原片對齊。只有口播要整段替換時,再去掉原聲。
合成前只盯三件事
- 標點:引號、刪節號容易造成怪停頓,審校時改成句號或逗號。
- 一句一氣口:一條軸裡塞兩句,合成會在不該換氣的地方換氣。
- 中英混排:專名可留英文,但整句中英來回跳時,用自動偵測分音色,比鎖死一種聲音更穩。
常見翻車
把配音當成「整段朗讀」:片頭空鏡、笑聲、過門都會被念出來。先把這些軸刪掉或留空。合成完仍要聽一遍——模型負責快,口型和音量的最後一公里還是你。
出海還要譯文時,先翻譯、再配音,軸仍然不動。整條後期順序寫在2026 年創作者後期。
看完不如直接做一條。免費額度即開即用。