
配音最容易翻车的,不是音色「不够像人」,而是把字幕导出到另一个软件再合成:轴丢了,口型对不上,改一句就要整段重录。处理台里更稳的做法是:先把字幕审完,再按同一条时间轴逐段合成。配音作为额外音轨写入,默认可留着原声。
先有干净的轴,再合成
没有时间戳的文案,模型只能从头念到尾,长短全靠猜。正确顺序:
- 先出带起止点的字幕(听写、硬字幕或导入 SRT)。
- 审校错字、人名和气口,再开配音。
- 合成只读当前轴上的文字,不另开工程。
十分钟字幕路径见这篇教程。轴乱了再配,只会把错误放大。
同一条轴上的配音路径
- 打开处理台,用已有工程或拖入本地 MP4 / MOV。素材留在浏览器里。
- 确认字幕轴已审过。还没有轴时,可先识别或导入 SRT。
- 勾选「AI 配音」。中文选晓晴;英文从多种音色里挑。自动检测时,中文段落用晓晴,英文段落用你选的英文音色。
- 默认语速贴合每条字幕时长。某一句被拉得又尖又快,先改那条的字数或起止点,不要整片手动拉到 1.4 倍。
- 默认勾选「保留原声」。配音写入额外音轨,画面仍跟原片对齐。只有口播要整段替换时,再去掉原声。
合成前只盯三件事
- 标点:引号、省略号容易造成怪停顿,审校时改成句号或逗号。
- 一句一气口:一条轴里塞两句,合成会在不该换气的地方换气。
- 中英混排:专名可留英文,但整句中英来回跳时,用自动检测分音色,比锁死一种声音更稳。
常见翻车
把配音当成「整段朗读」:片头空镜、笑声、过门都会被念出来。先把这些轴删掉或留空。合成完仍要听一遍——模型负责快,口型和音量的最后一公里还是你。
出海还要译文时,先翻译、再配音,轴仍然不动。整条后期顺序写在2026 年创作者后期。
看完不如直接做一条。免费额度即开即用。