← Блог

Как сделать2026-09-15 · 7 Читать

Озвучка ИИ на той же шкале субтитров | AI Video Factory

Озвучка ИИ на той же шкале субтитров | AI Video Factory

Озвучка чаще ломается не из‑за тембра, а потому что субтитры уехали в другое приложение: шкала пропала, рот не совпадает, каждая правка — полная перезапись. В студии спокойнее так: сначала правьте реплики, потом синтезируйте каждую строку на той же шкале. Озвучка пишется отдельной дорожкой, исходный звук можно оставить.

Сначала чистые реплики

Текст без таймкодов читается с начала до конца, длина — наугад. Порядок, который держится:

  1. Сначала список реплик с входом и выходом (речь, OCR вшитых титров или импорт SRT).
  2. Опечатки, имена и вдохи — потом озвучка.
  3. Синтез читает текущие реплики, второй проект не открывайте.

Десятиминутный путь субтитров — в этом гайде. Озвучивать кривую шкалу — только масштабировать ошибки.

Озвучка на той же шкале

  1. Откройте студию и продолжите проект или перетащите локальный MP4 / MOV. Файл остаётся в браузере.
  2. Проверьте, что список уже вычитан. Если шкалы ещё нет — сначала распознать речь или импортировать SRT.
  3. Отметьте ИИ-озвучку. Китайский — 晓晴; английский — из нескольких голосов. При авто китайские строки идут голосом 晓晴, английские — выбранным английским.
  4. Скорость по умолчанию следует длительности каждой реплики. Если одна строка звучит тонко и спешно — меняйте слова или вход/выход, не тяните весь файл на 1,4×.
  5. Исходный звук по умолчанию включён. Озвучка — отдельная дорожка, картинка остаётся на исходнике. Выключайте оригинал только когда закадр должен его полностью заменить.

В бесплатном тарифе один запуск озвучки в месяц. Голоса, микс и лимиты — на возможностях и ценах.

Перед синтезом смотрите только три вещи

  • Пунктуация: кавычки и многоточия дают странные паузы — замените на точку или запятую.
  • Один вдох на реплику: две фразы в одной строке заставляют голос вдохнуть не там.
  • Смесь китайского и английского: имена брендов могут остаться на английском. Если целые клаузы меняют язык, авто с двумя голосами стабильнее одной зафиксированной.

Что обычно ломается

Озвучка как «прочитать весь файл»: пустые заставки, смех и джинглы тоже произносятся. Сначала удалите или очистите эти реплики. Всегда прослушайте — модель даёт скорость, рот и уровень — ваши.

Если нужен ещё перевод: сначала перевод, потом озвучка; шкала не двигается. Полный порядок — в постпродакшене автора 2026.

Дочитали? Сделайте одно. Бесплатная квота уже есть.