2 сентября 2026 г.
Gemini 3.8 Flash стал самым дешёвым на своём уровне интеллекта: $0.58 за задачу в замере Artificial Analysis
Плюс 3 балла к прошлой версии при тех же ценах за токен: промо-тариф действует до конца года.

Artificial Analysis
@artificialanlys
Google выпустила Gemini 3.8 Flash — четвёртую Flash-модель менее чем за четыре месяца. Она набирает 59 баллов в Artificial Analysis Intelligence Index и выходит на Парето-границу «интеллект / стоимость задачи». @GoogleDeepMind выпустила Gemini 3.8 Flash сегодня. На высоком уровне рассуждения она набирает 59 баллов в Artificial Analysis Intelligence Index — на 3 балла больше, чем Gemini 3.7 Flash, и вровень с не-максимальными режимами рассуждения GPT-5.6 Sol (xhigh, 59) и Grok 4.6 (medium, 59). Gemini 3.8 Flash сохраняет нынешние промо-цены Gemini 3.7 Flash до конца года ($0.75/$3.75 за миллион входных/выходных токенов) и сидит на Парето-границе «интеллект / стоимость задачи» с $0.58 за задачу. Это сопоставимо с GPT-5.6 Terra (max, $0.53), но примерно на 40% выше, чем у предшественницы — из-за роста среднего числа выходных токенов на задачу на 30%, до 48 тысяч, и большего числа ходов в агентских оценках. Ключевые результаты бенчмарков по трём уровням рассуждения Gemini 3.8 Flash: ➤ Плюс 3 балла в Intelligence Index: Gemini 3.8 Flash (high) набирает 59 баллов в Artificial Analysis Intelligence Index — на 3 больше, чем Gemini 3.7 Flash (high, 56). На medium она набирает 57, вровень с GPT-5.6 Terra (max, 57) и Muse Spark 1.2 (xhigh, 57). На low — 52, вровень с Gemini 3.6 Flash (high, 52), при на 30% меньшей стоимости задачи и примерно втрое меньшем времени на задачу. ➤ Рост агентских способностей: 3 балла прироста Gemini 3.8 Flash в Artificial Analysis Intelligence Index в основном дают агентские оценки — 𝜏³-Banking (работа с инструментами), Terminal-Bench v2.1 (код) и GDPval-AA v2 (реальные задачи). Самый большой прирост на 𝜏³-Banking: плюс 12 пунктов к Gemini 3.7 Flash, до 45%. ➤ Парето-граница «интеллект / стоимость задачи»: задача Intelligence Index обходится Gemini 3.8 Flash (high) в $0.58 — это самая дешёвая модель на её уровне интеллекта. Это примерно на 40% больше, чем у Gemini 3.7 Flash ($0.40), при неизменных ценах за токен — из-за роста выходных токенов на задачу на 30% и большего числа ходов в агентских оценках. На medium стоимость задачи падает до $0.41, на low — до $0.24. ➤ Скорость вывода остаётся высокой, но время на задачу растёт: на high Gemini 3.8 Flash выдаёт в среднем ~300 выходных токенов в секунду при 2,5 минутах на задачу — чуть быстрее GPT-5.6 Luna (max, 2,6 минуты) и GPT-5.6 Terra (max, 3,3). По сравнению с Gemini 3.7 Flash возросший расход токенов увеличивает время на задачу с 2,2 до 2,5 минуты и ставит её позади Claude Fable 5.1 (medium, 2,1 минуты). На low время на задачу падает до 0,8 минуты, что выводит Gemini 3.8 Flash на Парето-границу «интеллект / время задачи». Ключевые детали модели: ➤ Контекстное окно: 1M токенов, как у Gemini 3.7 Flash ➤ Мультимодальность: текст, изображения, видео и речь на входе, текст на выходе ➤ Цены: $0.75/$3.75 за 1M входных/выходных токенов до конца года — те же промо-цены, что сейчас у Gemini 3.7 Flash. Стандартные цены — $1.50/$7.50 за 1M входных/выходных токенов. Кэшированные входные токены сохраняют скидку 90%

· 35 тыс. просмотров
Цены за токен Google не тронула, а задача в замере подорожала на 40%: модель думает дольше и пишет больше.
Gemini 3.8 Flash вышел через три недели после 3.7 Flash, четвёртым Flash за четыре месяца. Практик на бюджетных моделях платит за решённые задачи, а не за токены, и тут новая модель дешевле всех на своём уровне интеллекта.
Что выросло. Прошлая версия набирала 56 баллов в индексе Artificial Analysis, задача замера стоила $0.40. Новая набрала 59, задача стоит $0.58: расход выходных токенов вырос на 30%, до 48 тысяч на задачу. Три балла прироста дали агентские тесты — на банковском 𝜏³-Banking модель выросла сразу на 12 пунктов, до 45%.
Скорость осталась рекордной: 304,6 токена в секунду, первое место среди 195 моделей замера. Время на задачу выросло с 2,2 до 2,5 минуты.
Как включить. Подписчикам Google AI Pro и Ultra модель уже доступна в приложении Gemini, в AI Mode Поиска и в Google Sheets. Разработчикам она открыта в Google AI Studio и Gemini API под именем gemini-3.8-flash, с тремя уровнями рассуждения: low, medium и high. Бесплатный тир API тоже работает, но контент с него Google использует для улучшения своих продуктов.
До 31 декабря действует промо-тариф: $0.75 за миллион входных токенов и $3.75 за миллион выходных, включая thinking. Режимы Batch и Flex срезают ещё половину промо-ставки, кэш контекста даёт скидку 90%.
С 1 января 2027 промо заканчивается: тарифы удваиваются, до $1.50 за вход и $7.50 за выход за миллион токенов.
Первоисточник