23 сентября 2026 г.
Голос для приложения теперь собирается из промпта: Gemini говорит на 100+ языках
23 сентября Google представила две модели Gemini 3.8 Flash TTS и Flash-Lite TTS: они создают речь по текстовому промпту на 100+ языках. Модели заявлены для Google AI Studio, Gemini Notebook и Gemini API. Они умеют вести диалог за двух спикеров, добавлять смех, вздохи и короткие реплики слушателя.

17 сентября в документации Gemini API для озвучки ещё стояла Gemini 3.1 Flash TTS Preview с лимитом сессии в 32k токенов. Теперь Google добавляет две версии 3.8 и заявляет первое место в Hume AI Voice Design: 71,4 балла, включая 60,8 за моделирование акцента.
Голос под задачу. Для постоянного голосового профиля достаточно 30-секундного аудиосэмпла, если у пользователя есть права на голос. Google также заявила каталог из 2 000+ готовых голосов, а каждый клип получает водяной знак SynthID.
Следующей вехой станут независимые замеры качества и задержки Gemini 3.8 Flash TTS в API.
Первоисточник
