23 августа 2026 г.
Агент на 27 млрд параметров обыграл Opus 4.8 и Codex: 73% задач на своём бенчмарке
Faraday от Inherent управляет GPT-5.5 Codex как инструментом и обыгрывает его же на 73% научных задач.
Faraday не спорит с большими моделями. Он ими командует: в замерах агент гоняет GPT-5.5 Codex как рабочий инструмент.
Британская Inherent переставила вопрос: научную задачу выигрывает не размер модели, а слой поверх кодинг-агента. В самом Faraday 27 млрд параметров поверх открытой Qwen 3.6, дообученных на длинных задачах с наградой.
Раньше и теперь. Чтобы обойти сильную модель, брали модель побольше. Теперь Faraday обыгрывает Claude Opus 4.8 и GPT-5.5 Codex, командуя тем же Codex: 73% побед на задачах своего типа и 60% на отложенных.
Отрыв при этом скромный: в среднем +6% к Opus 4.8 и +8% к Codex на тестовых 68 задачах. Бенчмарк Replica Inherent собрала сама, в нём 310 задач на воспроизведение графиков из 100 статей по ML и AI-for-science за 1990–2026 годы. Ответы судит модель по пяти критериям, от совпадения графика до научной добросовестности, а шкалу сверяли с экспертами, публиковавшимися на ICML, ICLR и NeurIPS.
Пощупать нечего. Весов, API, waitlist и репозитория у Faraday нет. Единственный вход, который назвали авторы, — письмо на faraday@inherentlaboratories.com.
За агентом стоят четыре выходца из Google DeepMind. В Inherent около 12 человек и офис в лондонском King's Cross, в мае 2026 стартап поднял $50 млн seed: лиды Index Ventures и Radical Ventures, среди участников фонд Nvidia.
Проверить счёт со стороны нельзя, пока Inherent не откроет Faraday шире, чем по письму на почту.
Первоисточник