Google выпустила две новые ИИ-модели для синтеза речи — Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS. Компания анонсировала их в Google AI Studio. Обе модели умеют клонировать голос пользователя, генерировать речь из текста и редактировать каждую реплику отдельно. Но бесплатный доступ имеет жёсткие ограничения.
Gemini 3.8 Flash TTS — полная версия модели для синтеза речи. Flash-Lite — урезанная альтернатива с меньшими возможностями. Обе генерируют речь из текста и сохраняют тембр голоса говорящего. Пользователь загружает образец голоса, получает синтез и может править отдельные фразы без перезаписи всего файла целиком.
Для подкастеров и авторов аудиоконтента это способ получить естественный голос без затрат на студийную запись. Для разработчиков — встроить синтез в приложения без подключения сторонних сервисов. Но ограничения бесплатной версии могут не устроить тех, кто планирует масштабное коммерческое использование без доплаты.
По имеющимся данным, модели доступны в Google AI Studio на бесплатной основе. Полная версия Flash TTS ориентирована на сложные запросы. Flash-Lite обрабатывает стандартные задачи быстрее. Разница между ними — в глубине обработки звука и количестве доступных функций.
Точные условия бесплатного доступа Google не раскрыла. Разработчикам известно только, что определённые ограничения существуют. Количество запросов и максимальная длина синтеза остаются за бортом публичной документации. Взнос за коммерческое использование пока не объявлен. Компания молчит о будущем тарифе и оставляет пользователей в неопределённости.
А вы уже пробовали озвучить текст искусственным интеллектом и остались недовольны качеством? Подобрать модель под задачу, сравнить параметры и проверить результат без программирования поможет нейросеть AiGENDA — покажет, какой вариант подходит лучше всего. Первый запрос — абсолютно бесплатно. Если понравится результат, сами выберете удобный тариф.
