./новости · 28 июля 2026 г.
новость
Искать уязвимости стало в 10 раз дешевле: Grok 4.5 обошёл всех по цене за балл
источник: @rauchg · X·
машинная выжимка · сверена с источником

Guillermo Rauch
@rauchg
В наших свежих прогонах на deepsec.sh Grok 4.5 вышел лучшей моделью по кибербезопасности в соотношении цены и качества. Он в 10 раз дешевле Sol, в 5,7 раза дешевле Opus 5 и в 2,2 раза дешевле Kimi K3 - и при этом работает на уровне Kimi. Sol остаётся передовой моделью и идёт впереди Opus 5.
DeepsecBench оценивает модели по точности, цене и скорости в поиске уязвимостей. Свежие результаты: ▪️ GPT-5.6 Sol набирает больше всех ▪️ Kimi K3 берёт половину верхнего балла за 1/5 цены ▪️ Grok 4.5 выигрывает по соотношению балла и цены в топ-10 https://vercel.com/blog/deepsecbench-evaluating-model-performance-in-finding-cybersecurity-6O29ShaGQlHGINBsMEJSzR/21706b5aba
· 6,4 тыс. просмотров
Grok 4.5 обошёлся в 10 раз дешевле GPT-5.6 Sol на бенчмарке DeepsecBench, результаты Vercel выложила 27 июля 2026. Он же дешевле Opus 5 в 5,7 раза и Kimi K3 в 2,2 раза, а точность держит на уровне Kimi. Первое место по баллам осталось за Sol, Opus 5 идёт следом.
Почему это важно: DeepsecBench меряет три вещи разом: точность поиска уязвимостей, цену и скорость. Раньше расклад читался просто: хочешь максимум находок - бери самую дорогую модель. Sol и сейчас набирает больше всех. Но Kimi K3 берёт половину верхнего балла за пятую часть цены, а Grok 4.5 повторяет точность Kimi ещё дешевле. Арифметика простая: на бюджете одного прогона Sol помещается десять прогонов Grok. Конкретных цен за прогон, размера выборки и разбивки по типам уязвимостей Раух не называет - только кратности.
Что дальше: Методика и таблица лежат в блоге Vercel. Прогнать свой репозиторий двумя наборами, Sol и Grok 4.5, и сверить не баллы, а число подтверждённых находок на рубль: половина верхнего балла означает половину найденных дыр, а не половину качества отчёта.
первоисточник