./новости · 23 июля 2026 г.
новость
GPT-5.6 Sol тратит меньше токенов на ту же задачу: OpenAI держит почти весь фронтир эффективности
источник: @artificialanlys на X ↗·
машинная выжимка · сверена с источником

Artificial Analysis
@artificialanlys
Несмотря на крупные запуски от 5+ лабораторий в этом месяце, OpenAI занимает большую часть фронтира Парето по токен-эффективности. Мы измеряем, сколько output-токенов модель выдаёт на задачу, в Artificial Analysis Intelligence Index. Output-токены складываются из токенов ответа (насколько модель многословна) и токенов рассуждения (насколько долго она думает перед ответом). Токены рассуждения дают модели способ потратить вычисления во время инференса и улучшить ответ. Output-токены во многом определяют и цену, и время на задачу. Разные уровни effort у GPT-5.6 Sol доминируют на фронтире - Terra и Luna выдают заметно больше токенов при любом уровне интеллекта.

· 1,7 тыс. просмотров
OpenAI занимает большую часть фронтира Парето по токен-эффективности в замере Artificial Analysis от 23 июля 2026 - несмотря на запуски 5+ лабораторий за месяц. Разные уровни effort у GPT-5.6 Sol доминируют на этом фронтире, а модели Terra и Luna выдают больше токенов при том же уровне интеллекта. Output-токены складываются из токенов ответа и токенов рассуждения и определяют цену и время на задачу.
Почему это важно: Раньше выбор модели практик мерил по одному интеллекту, а расход считал грубо. Artificial Analysis добавила вторую ось: сколько output-токенов модель жжёт на ту же задачу. По этой оси GPT-5.6 Sol обходит соседей - за один уровень интеллекта Terra и Luna платят большим числом токенов, то есть большей ценой и большим временем на ответ. За месяц вышли релизы 5+ лабораторий, но фронтир эффективности остался за OpenAI. Конкретных цифр токенов на задачу в твите нет - только картина фронтира.
Что дальше: Прогнать свой рабочий модуль через GPT-5.6 Sol и через конкурента того же уровня интеллекта, свести счёт по output-токенам и времени на задачу - и решить, где переплата.