
听写慢、或者人名老错,常常不是额度问题,而是识别模式选反了。处理台里有两项:标准(较快)和增强(更准)。口齿清楚的口播先用标准;口音重、专名多、环境吵,再换增强。开跑前选定。关掉页面之后,免费版这个月不能再换模式重听。
先确认你走的是听写
识别模式只作用于语音识别。画面上只有烧录字、几乎没人声,改走硬字幕识别,换模式也听不到字。两条路怎么选,见听写还是 OCR。已经有能对嘴的 SRT,直接导入,见已有 SRT 就别再识别。
标准够用的片子:单人、吐字清楚、环境不太吵、专名不多。增强值得等的片子:口音混杂、品牌和型号密集、底噪大但人声还听得清。底噪大到听不清,先剪掉空镜,不要指望换模式。
开跑前选一次
- 打开处理台的字幕,拖入本地 MP4 / MOV。素材留在浏览器里。
- 等检测结束,勾选语音识别。在「识别模式」里选标准或增强。语言仍可用自动,见十分钟字幕。
- 第一次用增强会多下载本机模型,片短、口齿清楚不必等它。
- 识别完先审专名和数字。还没关页面、发现选错了,可以改模式再听一遍。关掉之后,免费版这个月的识别已经用掉。
- 轴定了再改样式或导出,见竖屏排版与SRT 还是烧录。
选定前只盯三件事
- 人声:单人清楚用标准。多人抢话,先剪再识别,不要立刻上增强。
- 专名:品牌、型号、人名密集,用增强,审校时仍要扫一遍。
- 次数:模式在点开始之前改。关页面后再换,要等下个月或升级。
常见翻车
30 秒清楚口播一上来就增强:下载更久,准确率几乎不变。增强听完仍有错字,反复重跑:模型负责快,最后一公里是你改轴。把增强当成 OCR 的替代:它不读画面上的字。
看完不如直接做一条。免费额度即开即用。