Как работает Текст в речь
Озвучка текста. MiniMax и ElevenLabs до 10 000 символов, OpenAI около 4 000.
Автор Umakhan Magomedov
Последнее обновление 4 дня назад
Текст в речь превращает написанный текст в аудиофайл. Введите или вставьте текст, выберите голос и нажмите Сгенерировать, чтобы получить результат за секунды.
Когда использовать
Создать озвучку для презентации, видео или подкаста
Прослушать переведённый текст вместо чтения
Тренировать произношение, генерируя аудио фраз на иностранном языке
Создать нарративный трек собственным клонированным голосом
Как запустить
Откройте Текст в речь на вкладке Инструменты.
Перейдите на вкладку Текст и введите или вставьте текст. Также можно нажать Вставить для вставки из буфера обмена или использовать голосовой ввод.
Перейдите на вкладку Голос и выберите голос: из OpenAI-голосов, стандартных голосов MiniMax или собственных Custom Voices.
Нажмите Сгенерировать. Аудиофайл появится на вкладке Результат.
ℹ️ Для голосов OpenAI можно добавить инструкцию на вкладке Голос, чтобы настроить тон, темп и стиль. Например: "Говори медленно и тепло" или "Используй официальный стиль диктора новостей."
Что вы получите
На вкладке Результат появляется плеер с аудиофайлом. Оттуда можно:
Воспроизвести аудио прямо в приложении
Скачать файл на устройство
Поделиться через системное меню
Сгенерировать заново с другими настройками
Каждый результат автоматически сохраняется в историю.
Сколько стоит
Стоимость зависит от длины текста и выбранного голоса. Голоса OpenAI тарифицируются по минутам предполагаемого аудио. Стандартные и кастомные голоса MiniMax тарифицируются по символам. Кастомные голоса при первом использовании включают единоразовую плату активации в 150 токенов. Подробные цены: Цены в токенах для каждого инструмента.
Лимит длины текста
MiniMax: до 10 000 символов за запрос
ElevenLabs: до 10 000 символов
OpenAI: примерно до 4 000 символов
Если текст длиннее, разбейте его или переключитесь на MiniMax. Приложение покажет ошибку и не запустит заведомо неудачную задачу.