2 сентября 2026 г.
Google продаёт уровень флагманов по цене мелкой модели: $0,75 за миллион токенов у Gemini 3.8 Flash
На экспертном тесте HLE-Verified модель взяла 54,9% — выше, чем Claude Opus 5 и GPT-5.6 Sol.

Мелкая модель Gemini обошла Claude Opus 5 на тесте экспертного рассуждения.
Разрыв меряется десятыми: 54,9% против 54,4%. Младшая модель Google встала в один класс с флагманами, а платить за неё нужно $0,75 за миллион входных токенов и $3,75 за выходные.
Окно на вход — миллион токенов, ответ не длиннее 64 тысяч. Цену Google держит до 31 декабря 2026, с 1 января тариф удваивается до $1,50 и $7,50. На бесплатном тарифе Gemini API модель пока отдают даром, вместе с кэшем контекста.
К прошлой версии прибавка неровная. На агентском тесте по финансам Vals модель поднялась с 59,0% у Gemini 3.7 Flash до 61,4%. На юридическом бенчмарке Harvey рост меньше: с 8,8% до 10,0%.
Счёт растёт не от цены. Artificial Analysis намерила 47 баллов в своём индексе интеллекта, 27-е место из 202 моделей и смешанную цену $0,58 за миллион токенов. На прогоне тестов модель выдала 140 млн выходных токенов при медиане 79 млн. Она болтлива, и за ту же задачу ты заплатишь больше, чем насчитал по прайсу.
Где взять. Разработчикам модель раздают в Google AI Studio, Android Studio, Antigravity и Stitch, компаниям — в Gemini Enterprise. Подписчикам Google AI Pro и Ultra она пришла в приложении Gemini, в AI Mode поиска и в Google Sheets. В Antigravity нужна версия 2.0, глубина размышления там переключается на каждую задачу.
В Gemini API модель зовётся `gemini-3.8-flash`, глубину думания задаёт `thinking_level` со значениями low, medium и high. Прежний `thinking_budget` больше не работает, а `minimal` вернёт ошибку. Gemini 3.7 Flash Google оставила поддержанной, старые сборки можно не трогать.
К 1 января 2027 та же модель будет стоить вдвое дороже, чем в день выхода.
Первоисточник