Настройки Перевода аудио: голос, модели и клонирование
Распознавание, модели перевода, озвучка, стили Qwen и оценка в токенах.
Автор Umakhan Magomedov
Последнее обновление Около 16 часов назад
Откройте лист настроек в Переводе аудио, чтобы управлять распознаванием речи, качеством перевода и озвучкой. В этой статье разобраны все опции и момент их применения.
Где найти настройки
Откройте Перевод аудио на вкладке Инструменты.
Нажмите значок Настройки в правом верхнем углу.
Измените распознавание, перевод или озвучку. Оценка в токенах обновится сразу.
ℹ️ Изменения распознавания и модели перевода применяются при следующей загрузке файла, не к текущему результату. Настройки озвучки влияют на следующую генерацию аудио.
Распознавание (речь в текст)
Выберите движок транскрипции загруженного аудио. По умолчанию: ElevenLabs Scribe.
Перевод
Выберите AI-модель для повторных переводов при смене языка или редактировании исходного текста.
⚠️ Автоматический пайплайн при первой загрузке всегда использует Gemini 3.8 Flash на бэкенде, независимо от выбранной здесь модели. Настройки влияют только на повторные переводы.
Озвучка без клонирования
Стандартные синтетические голоса. Образец из исходного аудио не используется.
Если ElevenLabs не поддерживает целевой язык, приложение автоматически переключается на OpenAI.
Озвучка с клонированием
Эти провайдеры клонируют голос говорящего из загруженного аудио или сохранённого Custom Voice.
MiniMax (рекомендуется)
Qwen
HeyGen
Поведение TTS
Редактирование перевода: изменение текста сбрасывает текущую озвучку. Нажмите воспроизведение для новой генерации.
Незавершённые и завершённые задачи: задачи MiniMax, Qwen и HeyGen продолжаются в фоне. При открытии из истории воспроизведение или опрос возобновляются.
Смена языка: если провайдер клонирования не поддерживает новый язык или аудио слишком короткое, приложение автоматически переключается на ElevenLabs.
Смена настроек: переключение провайдера, скорости, эмоции или стиля сбрасывает кэшированное аудио для текущего результата.
Часто задаваемые вопросы
Что делает регулировка скорости MiniMax?
Что делает регулировка скорости MiniMax?
Диапазон от 0.5x (медленнее) до 2.0x (быстрее). Меняет темп озвучки без повторной загрузки файла. Смена скорости сбрасывает текущее аудио.
Можно использовать стили Qwen с сохранённым Custom Voice?
Можно использовать стили Qwen с сохранённым Custom Voice?
Нет. Стили (Медленно, Быстро, Спокойно, Энергично и другие) работают только в режиме auto_clone при клонировании из файла. Сохранённые Custom Voices игнорируют стили.
HeyGen или MiniMax: что выбрать?
HeyGen или MiniMax: что выбрать?
MiniMax быстрее (~1 минута), дешевле (0.15 токена/сек) и поддерживает скорость и эмоции. HeyGen дольше (~10 минут), но часто звучит естественнее. HeyGen стоит 3.67 токена/сек.
Почему озвучка пропала после редактирования перевода?
Почему озвучка пропала после редактирования перевода?
Отредактированный текст не совпадает с сгенерированным аудио. Плеер сбрасывается, пока вы снова не нажмёте воспроизведение. Это предотвращает проигрывание несоответствующего аудио.
Аудио слишком короткое для клонирования. Какой минимум?
Аудио слишком короткое для клонирования. Какой минимум?
MiniMax требует минимум 10 секунд речи в файле. Qwen: минимум 3 секунды. Более короткие файлы переключают приложение на ElevenLabs.
ElevenLabs или OpenAI для стандартной озвучки?
ElevenLabs или OpenAI для стандартной озвучки?
ElevenLabs по умолчанию: быстрее (~2 секунды) и дешевле (0.01 токена/сек) для большинства языков. OpenAI (0.03 токена/сек) используется как запасной вариант, если ElevenLabs не поддерживает целевой язык.
Когда списываются 150 токенов за MiniMax?
Когда списываются 150 токенов за MiniMax?
150 токенов за активацию клона списываются при первом клонировании конкретного голоса (auto_clone из файла или первое использование сохранённого Custom Voice). Повторные генерации с тем же активированным голосом стоят только 0.15 токена/сек.
Можно использовать HeyGen Custom Voice из аккаунта?
Можно использовать HeyGen Custom Voice из аккаунта?
Нет. HeyGen в Переводе аудио клонирует напрямую из загруженного файла. Сохранённые голоса поддерживает только MiniMax через Custom Voices.
Смотрите также
Это было полезно?
Ещё в разделе Перевести аудио
Как работает функция «Перевод аудио»Нужна помощь? Предложить идею