2 сентября 2026 г.
Gemini 3.8 Flash не заменит самые умные модели: 19,1% против 51,8% у Opus 5 на агентских задачах
Итан Моллик получил ранний доступ: Gemini 3.8 Flash хороша для своей линейки, но на сложных агентских задачах отстаёт от Opus 5 почти втрое.

Ethan Mollick
@emollick
У меня был ранний доступ к Gemini 3.8 Flash. Как модель линейки Flash она очень хороша, но с самыми умными моделями всё-таки не сравнится. Вот её версия шейдера по тем же промптам (выдала очень быстро).
Шейдер с затопленной неоготической башней на twigl, сделала Fable 5.1 по тому же промпту (сравните с Fable 5 в цитируемом твите и с моделями до неё).
· 3 тыс. просмотров
Итан Моллик получил Gemini 3.8 Flash раньше публики и скормил ей тот же промпт, которым гонял Fable 5.1.
Ответ пришёл быстро. Вердикт автора короткий: для линейки Flash модель очень хороша, но с самыми умными она не в одном ряду.
Где потолок. На Terminal-bench 4.0, наборе сложных агентских задач, Flash берёт 19,1%, а Claude Opus 5 там же 51,8%. На OSWorld-2.0, где модель управляет компьютером, счёт 59,0% против 75,4%.
Раньше быстрые дешёвые модели брали на мелочь, а сложное отдавали топам. Теперь граница проходит не по всей работе, а по её типу: на длинных задачах по коду DeepSWE v1.1 даёт Flash 71,0% против 74,0% у Opus 5, а на Terminal-bench 2.1 она берёт 89,4% и обходит его.
Как взять. Модель уже работает в Google AI Studio, Gemini API, Google Antigravity и Android Studio, а в приложении Gemini и AI Mode в Поиске её видят подписчики Google AI Pro и Ultra. Минимальный вызов в Python SDK google-genai выглядит как client.interactions.create(model="gemini-3.8-flash", input=...), а глубину раздумий задаёт параметр thinking_level со значениями low, medium и high, по умолчанию medium.
Цена вводная и держится до 31 декабря 2026: $0,75 за миллион входных токенов и $3,75 за миллион выходных. С 1 января 2027 Google включает стандартную, вдвое дороже. Контекст на вход 1 048 576 токенов, на выход 65 536.
Независимый замер Artificial Analysis показал 302 токена в секунду на выдаче и 13,3 секунды ожидания первого токена.
Вводная цена держится до 31 декабря 2026, с 1 января 2027 она вырастает вдвое.
Первоисточник
