Как работает функция «Перевод аудио»
Автоматическое распознавание речи, перевод и составление резюме в приложении Translate Audio.
Автор Umakhan Magomedov
Последнее обновление 1 день назад
Функция «Перевести аудио» принимает аудиозапись с вашего устройства, по ссылке или из мессенджера, выполняет распознавание речи, переводит текст и автоматически генерирует краткое резюме. Вы получаете исходный текст, перевод и резюме, не нажимая кнопку «Перевести».
Когда использовать
Чтобы понять голосовое сообщение из Telegram, WhatsApp или другого мессенджера
Получить перевод подкаста, интервью или аудиозаписи
Транскрибировать и перевести запись лекции или встречи
Прослушивать переведённый контент в аудиоформате, а не просто читать его
Что можно загрузить
Форматы: MP3, M4A, WAV, OGG, FLAC, AAC, OPUS, WebM. Также принимаются видеофайлы: звуковая дорожка извлекается автоматически.
Ограничения по размеру:
Полный список ограничений для всех инструментов: Поддерживаемые форматы файлов, размеры и источники.
Источники:
Файл с вашего устройства или из галереи (веб, iOS, Android)
Аудио, отправленное через мессенджер: Telegram, WhatsApp, Viber, iMessage (iOS и Android)
Ссылка на YouTube, Instagram или TikTok, либо прямой URL-адрес аудио- или видеофайла
Как запустить
Откройте «Перевести аудио» на вкладке «Инструменты» в веб-версии, на iOS или Android.
Выберите источник: нажмите «Выбрать» для локального файла, «Вставить ссылку» для URL-адреса или поделитесь аудио из мессенджера.
Обработка начинается автоматически: сначала распознавание речи, затем перевод, а затем создание резюме. Отдельной кнопки «Перевести» нет.
Следите за ходом работы на трёх вкладках: «Исходный текст», «Перевод» и «Резюме».
На вкладке «Перевод» нажмите кнопку воспроизведения, чтобы прослушать озвученный перевод. При необходимости отредактируйте текст или измените язык перевода.
ℹ️ Чтобы поделиться голосовым сообщением из Telegram или WhatsApp, откройте сообщение, нажмите «Поделиться» и выберите «VocaLingo». Пошаговые инструкции: Как отправить аудиофайл через мессенджеры.
Что вы получаете
Результаты сгруппированы по трём вкладкам:
«Исходный текст»: расшифрованная исходная речь с мини-плеером для загруженного файла.
Перевод: переведённый текст и аудиозапись на языке перевода, которую можно воспроизвести. Вы можете отредактировать перевод и заново сгенерировать аудиозапись.
Резюме: краткое структурированное резюме содержания, сгенерированное в рамках автоматического процесса.
Результаты автоматически сохраняются в «Истории». Вы можете вновь открыть любой предыдущий результат, нажав на значок «История», без повторной загрузки файла. На бесплатных аккаунтах сохраняется до 3 записей на каждый инструмент; у аккаунтов Premium история неограниченная. См. История: сохранение, восстановление и удаление результатов.
Настройки распознавания, перевода и озвучивания
Нажмите значок «Настройки», чтобы выбрать поставщика услуг распознавания речи, модель перевода и поставщика услуг озвучивания. Изменения в моделях распознавания и перевода вступают в силу при следующей загрузке. Настройки озвучивания влияют на следующее создание аудиозаписи.
Подробная информация о каждой опции: Настройки перевода аудио.
Сколько это стоит
Инструмент взимает токены за распознавание речи, перевод текста, создание резюме и дополнительный голосовой комментарий. Стоимость зависит от продолжительности аудиозаписи, объема текста и выбранных вами поставщиков. Таблицы и примеры см. на странице Стоимость токенов для каждого инструмента.
Часто задаваемые вопросы
На какие языки можно переводить?
На какие языки можно переводить?
Translate Audio поддерживает 107 языков перевода — тот же набор, что и в Text Translator. Выберите язык в верхней части вкладки «Перевод».
Почему для первого перевода всегда используется Gemini 3, даже если я выбрал другую модель?
Почему для первого перевода всегда используется Gemini 3, даже если я выбрал другую модель?
Автоматический конвейер при загрузке всегда выполняет перевод с помощью Gemini 3 на сервере. Модель перевода, указанная в «Настройках», применяется только при повторном переводе: когда вы меняете язык перевода или редактируете исходный текст.
Можно ли загрузить видеофайл?
Можно ли загрузить видеофайл?
Да. Приложение автоматически извлекает звуковую дорожку. Если вам нужно дублированное видео с синхронизацией движения губ, воспользуйтесь вместо этого функцией «Translate Video».
Можно ли изменить язык перевода после загрузки?
Можно ли изменить язык перевода после загрузки?
Да. Переключите язык на вкладке «Перевод». Текст переводится заново с использованием выбранной вами модели перевода из «Настроек». Новая озвучка генерируется при нажатии кнопки воспроизведения.
Влияет ли редактирование перевода на аудио?
Влияет ли редактирование перевода на аудио?
Да. Редактирование перевода очищает текущий голосовой комментарий. Нажмите «Воспроизвести» ещё раз, чтобы сгенерировать новый аудиофайл. Ожидающие выполнения или завершённые фоновые задания возобновляются, когда вы снова открываете результат из «Истории».
Сколько записей в истории я могу сохранить?
Сколько записей в истории я могу сохранить?
В аккаунтах без премиум-доступа хранится до 3 результатов функции «Перевод аудио». Старые записи удаляются автоматически при превышении лимита. У подписчиков премиум-доступа история хранится без ограничений.
Откуда берутся цены на распознавание и озвучку?
Откуда берутся цены на распознавание и озвучку?
Для каждого этапа установлена своя стоимость токенов. Распознавание оплачивается за секунду аудиозаписи, перевод — за 1 000 символов, озвучка — за секунду сгенерированной речи. Полные таблицы: Стоимость токенов для каждого инструмента.
Связанные статьи
Ещё в разделе Перевести аудио
Настройки «Перевод аудио»: голос, модели и клонированиеНужна помощь? Предложить идею