28 июля 2026 г.
Дешёвая модель для поиска уязвимостей нашлась: Grok 4.5 в 10 раз дешевле лидера DeepsecBench
27 июля Vercel показала свежие прогоны DeepsecBench: Grok 4.5 обходится в 10 раз дешевле лидера, GPT-5.6 Sol. По качеству Grok держится на уровне Kimi K3, а тот берёт половину от результата Sol при 1/5 его цены. Ещё две вилки: Grok дешевле Opus 5 в 5,7 раза и дешевле самой Kimi K3 в 2,2 раза.

Guillermo Rauch
@rauchg
В наших свежих прогонах на deepsec.sh Grok 4.5 вышел лучшей моделью по кибербезопасности в соотношении цены и качества. Он в 10 раз дешевле Sol, в 5,7 раза дешевле Opus 5 и в 2,2 раза дешевле Kimi K3 - и при этом работает на уровне Kimi. Sol остаётся передовой моделью и идёт впереди Opus 5.
DeepsecBench оценивает модели по точности, цене и скорости в поиске уязвимостей. Свежие результаты: ▪️ GPT-5.6 Sol набирает больше всех ▪️ Kimi K3 берёт половину верхнего балла за 1/5 цены ▪️ Grok 4.5 выигрывает по соотношению балла и цены в топ-10 https://vercel.com/blog/deepsecbench-evaluating-model-performance-in-finding-cybersecurity-6O29ShaGQlHGINBsMEJSzR/21706b5aba
· 4,9 млн просмотров
Почему это важно: Раньше на секьюрити-прогон брали самую умную модель и платили по её прайсу. Vercel померила сразу три вещи: точность, цену и скорость поиска уязвимостей. Картина разъехалась. Sol находит больше всех и идёт впереди Opus 5, но Grok 4.5 выдаёт результат уровня Kimi K3 за десятую часть денег Sol. Практику это даёт два режима вместо одного: разовый аудит перед релизом гонять на Sol, а регулярную проверку каждого PR - на Grok. Сколько баллов набрала каждая модель и на каком корпусе уязвимостей их гоняли, в твите не сказано: за цифрами отправляют в блог Vercel.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Что дальше: Прогоните свой репозиторий дважды, Sol и Grok 4.5, и сравните две вещи: сколько находок совпало и во сколько обошёлся каждый прогон. Методика и полная таблица лежат в блоге Vercel.
Первоисточник