./новости · 27 июля 2026 г.
новость
Искать уязвимости можно не самой дорогой моделью: у Grok 4.5 лучший балл за деньги в топ-10
источник: @vercel · X·
машинная выжимка · сверена с источником

Vercel
@vercel
DeepsecBench измеряет точность, стоимость и скорость моделей в поиске уязвимостей. Свежие результаты: ▪️ GPT-5.6 Sol набрал больше всех ▪️ Kimi K3 даёт половину лучшего результата за 1/5 цены ▪️ Grok 4.5 - лучшее соотношение результата и цены в топ-10 https://vercel.com/blog/deepsecbench-evaluating-model-performance-in-finding-cybersecurity-6O29ShaGQlHGINBsMEJSzR/21706b5aba
· 11,2 тыс. просмотров
Vercel выложила свежие результаты DeepsecBench 27 июля 2026: по точности поиска уязвимостей первым идёт GPT-5.6 Sol. Kimi K3 набирает половину топ-балла и стоит в 5 раз дешевле. Внутри топ-10 лучшее соотношение балла и цены у Grok 4.5.
Почему это важно: Раньше модели для security-ревью выбирали по одной цифре: кто точнее нашёл дыры, тот и лучший. DeepsecBench меряет точность, цену и скорость сразу, и порядок мест перестаёт совпадать с порядком счетов. Kimi K3 отстаёт от лидера вдвое по баллу, но обходится впятеро дешевле: на потоковом прогоне репозиториев это разные суммы в конце месяца. Состав задач и конкретные цены в анонсе не названы, только доли от лидера.
Что дальше: Полная таблица лежит в блоге Vercel. Практический замер: прогнать свой модуль сначала лидером, потом дешёвой моделью из топ-10 и сравнить два списка найденных дыр вместе со счётом.
первоисточник