20 августа 2026 г.
Максимум мышления Opus 5 не окупается: medium стоит вдвое дешевле xhigh и решает больше задач
Opus 5 на medium дал 53,4% на FrontierCode при $4,31 за задачу, на xhigh упал до 43,6% и подорожал до $9,14.

Cline
@cline
PSA: используйте medium thinking effort вместо xhigh. Opus 5 на medium занял 2-е место на FrontierCode с 53,4% при $4,31 за задачу, а на xhigh откатился на 16-е место: 43,6% при $9,14 за задачу. Вдвое дешевле и на 10% лучше.

· 467 просмотров
Самая дорогая настройка Opus 5 на коде оказалась и самой слабой.
Команда Cline прогнала обе на FrontierCode: medium встал на 2-е место, xhigh откатился на 16-е. Половина денег и почти 10 пунктов разницы в пользу medium.
Совет вендора сменился. Для Opus 4.7 и 4.8 доки Anthropic требовали начинать с xhigh на коде и агентных задачах. Для Opus 5 они советуют начинать с high, это дефолт в API, а low и medium использовать щедро как главный рычаг цены и времени, пока свои замеры держат качество.
Сам бенч отдельным критерием смотрит на границы правок. FrontierCode проверяет scope, чтобы патч трогал только нужные файлы без лишнего рефакторинга. В версии 1.1 там 150 задач и больше 1000 критериев, часть помечена блокерами и режет балл при провале центрального требования.
Как переключить. В Cline уровень задаётся флагом `cline --thinking medium`, и medium там стоит по умолчанию. В API уровень живёт в поле `output_config.effort` рядом с моделью, а не внутри объекта thinking. В приложении Claude достаточно кликнуть по имени модели рядом с кнопкой отправки и выбрать Effort.
Уровень выбирают в начале сессии и держат постоянным. Смена effort между запросами обнуляет prompt cache: значение зашито в промпт. Разовое отклонение делают подсказкой в последнем сообщении.
В доках Anthropic это записано правилом: настройки, перенесённые с прошлой модели, перемеряются свежим effort-sweep.
Первоисточник