Перейти к основному содержимому
Преобразование текста в речь

Как работает функция «Преобразование текста в речь»

Преобразование текста в аудио. MiniMax и ElevenLabs — до 10 000 символов, OpenAI — около 4 000.

Автор Umakhan Magomedov

Последнее обновление 1 день назад

Функция «Преобразование текста в речь» преобразует письменный текст в аудиофайл с озвучкой. Введите или вставьте текст, выберите голос и нажмите «Создать», чтобы получить результат за считанные секунды.

Когда использовать

  • Создание голосового сопровождения для презентации, видео или подкаста

  • Прослушивание переведённого текста в аудиоформате вместо чтения

  • Потренируйтесь в произношении, сгенерировав аудиозапись фразы на иностранном языке

  • Создайте звуковую дорожку с собственным клонированным голосом


Как запустить

  1. Откройте функцию «Преобразование текста в речь» на вкладке «Инструменты».

  2. Перейдите на вкладку «Текст» и введите или вставьте текст. Вы также можете нажать «Вставить», чтобы вставить текст из буфера обмена, или воспользоваться голосовым вводом.

  3. Перейдите на вкладку «Голос» и выберите голос. Вы можете выбрать один из голосов OpenAI, стандартных голосов MiniMax или своих собственных пользовательских голосов.

  4. Нажмите «Создать». Аудиофайл появится на вкладке «Результат».

ℹ️ Для голосов OpenAI на вкладке «Голос» можно добавить голосовые инструкции, чтобы настроить тон, темп и стиль. Например: «Говори медленно и тепло» или «Используй формальный стиль диктора новостей».


Что вы получите

На вкладке «Результат» отображается аудиоплеер с сгенерированным файлом. Оттуда вы можете:

  • Прямо воспроизвести аудио

  • Скачать его на своё устройство

  • Поделиться им через системный лист обмена

  • При необходимости сгенерировать файл заново с другими настройками

Каждый результат автоматически сохраняется в «Истории».


Сколько это стоит

Стоимость зависит от длины текста и выбранного типа голоса. Голоса OpenAI оплачиваются за минуту расчетной аудиозаписи. Стандартные и пользовательские голоса MiniMax оплачиваются за символ. При первом включении пользовательских голосов взимается единовременная плата за настройку в размере 150 токенов. Полную разбивку цен см. на странице Стоимость токенов для каждого инструмента.


Часто задаваемые вопросы

Голоса OpenAI (alloy, nova, onyx и другие) — это оптимизированные для английского языка синтетические голоса с ярко выраженными индивидуальными особенностями. Голоса MiniMax являются многоязычными и включают как системные голоса, так и пользовательские голоса, которые вы создаете самостоятельно. Полное сравнение см. на странице Стандартные голоса против голосов OpenAI.

Да. Если вы создали пользовательский голос, он появится в списке голосов в разделе «Мои голоса». Выберите его и нажмите «Сгенерировать». Подробности см. на странице Использование пользовательских голосов в функции «Преобразование текста в речь».

Вы не можете редактировать аудиофайл напрямую. Чтобы получить другой результат, отредактируйте текст или измените настройки голоса и снова нажмите «Сгенерировать».

Каждый сгенерированный аудиофайл автоматически сохраняется в «Истории». Нажмите на значок истории, чтобы вновь открыть любой предыдущий результат.