24 сентября 2026 г.
Claude Code возглавил замер агентов для кода: Opus 5.5 набрал 66 баллов
23 сентября связка Claude Code и Opus 5.5 получила 66 баллов в индексе Artificial Analysis: выше всех измеренных агентов для кода. Opus 5 получил 60 баллов, Claude Fable 5.1 — 62. Anthropic снизила цену Opus до $4/$20 за миллион входных и выходных токенов, но один замеренный запуск стоит $13.04.

Artificial Analysis
@artificialanlys
Claude Opus 5.5 стал новым №1 в индексе агентов для кода Artificial Analysis. Он прибавил во всех трёх оценках, но стоимость задачи стала выше. В Claude Code на максимальном effort Opus 5.5 набирает 66 баллов в индексе агентов для кода. Это лучший результат, который мы измеряли. Он на 6 баллов выше Opus 5 с 60 баллами и на 4 балла выше Claude Fable 5.1 с 62 баллами. Anthropic снизила цены Opus с $5/$25 до $4/$20 за миллион входных и выходных токенов. Cache read подешевел с $0.50 до $0.20. Даже после этого стоимость задачи для Opus 5.5 составляет $13.04 против $10.79 у Opus 5, потому что модель расходует заметно больше токенов. Главное: ➤ Результат вырос во всех трёх оценках индекса агентов для кода: Terminal-Bench 4.0 поднялся с 54.5% до 63.1%, DeepSWE v1.1 с 62.5% до 68.4%, SWE-Atlas-QnA с 62.1% до 66.4%. Самый большой прирост у Terminal-Bench: 8.6 процентного пункта. ➤ Лучший результат обходится дороже всех: стоимость задачи Opus 5.5 составляет $13.04, на 21% выше $10.79 у Opus 5. На задачу уходит около 15.6 млн токенов против 11.4 млн у Opus 5, включая в 2.4 раза больше выходных токенов. ➤ Opus 5.5 расширяет границу Парето индекса агентов для кода по стоимости задачи. Ни одна более дешёвая модель в нашем сравнении не повторяет результат Opus 5.5. На дорогом краю граница поднялась выше. Другие детали модели: ➤ Цена: $4/$20 за миллион входных и выходных токенов, на 20% ниже Opus 5. Cache read стоит $0.20 за миллион токенов, на 60% ниже прежних $0.50. ➤ Настройка оценки: Claude Code на максимальном effort измеряли на DeepSWE v1.1, Terminal-Bench 4.0 и SWE-Atlas-QnA. Индекс агентов для кода даёт всем трём оценкам одинаковый вес.

· 7,9 тыс. просмотров
Раньше Claude Code с Opus 5 набирал 60 баллов и тратил $10.79 на задачу. Теперь Opus 5.5 получил 66, но стоит $13.04: модель расходует 15.6 млн токенов вместо 11.4 млн.
Цена токена упала. Anthropic снизила цены с $5/$25 до $4/$20 за миллион входных и выходных токенов, а cache read с $0.50 до $0.20. Для практики арифметика простая: шесть баллов индекса стоят на $2.25 дороже каждой измеренной задачи.
В API модель включается заменой `claude-opus-5` на `claude-opus-5-5`. Thinking больше нельзя отключить, нужно выбрать уровень effort. Индекс поровну складывает DeepSWE v1.1, Terminal-Bench 4.0 и SWE-Atlas-QnA: 303 задачи, по три попытки на каждую.
В этом сравнении ни одна более дешёвая модель не повторяет 66 баллов Opus 5.5.
Первоисточник
