23 сентября 2026 г.
Озвучку можно сменить без переписывания API: две модели Gemini 3.8 TTS работают по одной схеме
23 сентября Google открыл две модели Gemini 3.8 TTS с общей API-схемой. Flash TTS компания предназначает для сложных диалогов и длинной озвучки. До 31 декабря 2026 года миллион аудиотокенов стоит $9 у Flash и $6 у Flash-Lite.

Google AI Studio
@googleaistudio
Представляем Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS, наши самые выразительные на сегодняшний день модели для генерации звука. Эти модели помогают авторам, разработчикам и компаниям создавать более насыщенный и выразительный звук. Попробуйте их через Gemini API и в AI Studio: https://aistudio.google.com/generate-speech?model=gemini-3.8-flash-tts&e=0
· 6,5 тыс. просмотров
Раньше Gemini 3.1 Flash TTS Preview возвращала raw PCM. Теперь Gemini по умолчанию отдаёт WAV, а между Flash и Flash-Lite переключаются заменой имени модели. При миграции инструкции по стилю и метки спикеров нужно перенести в `speech_metadata`.
Два режима. В Google AI Studio доступны обе модели. Через Gemini API Google использует `POST /v1beta/interactions` с `response_format.type="audio"`, а готовый ответ можно сохранить как `out.wav`.
С 1 января 2027 года Google удвоит цены обеих моделей.
Первоисточник

