3 октября 2026 г.
GPT-6.1 Sol почти догнала Astra в Agent Arena: задачи обходятся на 81% дешевле
На 2 октября GPT-6.1 Sol занимает пятое место в Agent Arena и отстаёт от Astra на 1,04 процентного пункта.

Peter Gostev
@petergostev
В рейтинге Agent Arena GPT-6.1-Sol совсем близко к Astra, а стоимость задачи на 80% ниже. Это результаты на реальных пользовательских запросах.
Отличные новости: GPT-6.1 Sol (Max) от @OpenAi только что заняла 5-е место (+11,23%) в Agent Arena и изменила границу Парето! При медианной стоимости задачи $0,56 она отстаёт от GPT-6 Sol и GPT-6 Astra меньше чем на 2 процентных пункта, а обходится существенно дешевле: - На 39% дешевле GPT-6 Sol, при этом оценка выше на 1,52 пункта - На 81% дешевле GPT-6 Astra, при этом отставание составляет 1,04 пункта GPT-6.1 Sol также входит в пятёрку лидеров и обходится существенно дешевле других моделей: - На 88% дешевле Claude Fable 5.1 (Max), при этом отстаёт на 3,08 пункта от этой модели, которая занимает 1-е место - На 65% дешевле Clau

· 1 тыс. просмотров
GPT-6.1 Sol приблизилась к Astra по результатам реальных задач. При этом типичная задача обходится дешевле примерно в пять раз.
Цена задачи. В Agent Arena на 2 октября модели в режиме Max получили такие результаты:
| Модель | Медианная стоимость задачи | Net Improvement | Число сессий | | --- | --- | --- | --- | | GPT-6.1 Sol | $0,55 | 11,23% ±2,76% | 6 278 | | GPT-6 Astra | $2,93 | 12,27% ±2,23% | 11 717 |
Медианная стоимость означает, что половина задач стоила не дороже этой суммы. Net Improvement измеряет результат относительно средней модели в Arena, а не долю решённых задач.
Arena оценивает работу ИИ-агентов по пяти сигналам:
- Подтверждённый успех задачи. - Похвала и жалобы пользователя. - Реакция на указания пользователя. - Исправление ошибок команд Bash. - Выдуманные вызовы инструментов.
GPT-6.1 Sol обошла предыдущую GPT-6 Sol по оценке Arena. В расчётах Arena из цитируемого поста стоимость задачи Sol составляет $0,56, а сравнение выглядит так:
| Модель для сравнения | Насколько задача GPT-6.1 Sol дешевле | Разница в оценке GPT-6.1 Sol | | --- | --- | --- | | GPT-6 Sol | На 39% | Выше на 1,52 процентного пункта | | GPT-6 Astra | На 81% | Ниже на 1,04 процентного пункта | | Claude Fable 5.1 Max | На 88% | Ниже на 3,08 процентного пункта |
OpenAI получила похожее соотношение в собственном замере DeepSWE v1.1 от 29 сентября. GPT-6.1 Sol достигла результата Astra примерно за пятую часть стоимости и превысила лучший результат GPT-6 Sol на 6,4 процентного пункта при меньших затратах на рассуждение.
Как включить. В Codex CLI модель запускается командой `codex --model gpt-6.1-sol`. В открытой сессии переключение доступно через `/model`.
По условиям запуска от 29 сентября модель доступна в ChatGPT Work и Codex на платных планах от Plus до Enterprise и Edu. Для Enterprise и Edu её включает администратор. Free и Go в запуск не входят.
Для API нужно указать `model: "gpt-6.1-sol"`. Работа с инструментами требует Responses API, а Chat Completions поддерживается без инструментов.
Standard API стоит пятую часть тарифов Astra. Цены OpenAI от 29 сентября:
| Режим обработки | Цена за 1 млн токенов GPT-6.1 Sol | | --- | --- | | Вход | $2 | | Выход | $10 | | Вход из кэша | $0,10 |
У предыдущей GPT-6 Sol вход из кэша стоил $0,20 за миллион токенов. При запросе длиннее 272 000 входных токенов OpenAI повышает цену всего запроса: вход и кэш дорожают вдвое, выход — в полтора раза. Fast mode стоит вдвое дороже Standard.
В Agent Arena задачу можно отправить с файлами через arena.ai/agent, но сервис назначает модель случайно и не раскрывает её после обратной связи.
Первоисточник