19 сентября 2026 г.
Claude собирает следующего Claude: ИИ сам ведёт 26% исследований Anthropic
Claude ведёт 26% исследовательских работ Anthropic от начала до конца сам, в феврале 2026 было меньше 1%.
В мае 2026 больше 80% кода в продакшене Anthropic написал сам Claude.
До запуска Claude Code в феврале 2025 эта доля держалась в районе единиц процентов. 17 сентября 2026 компания опубликовала отчёт, где померила уже не код, а всю свою исследовательскую работу над моделями. Это первый публичный замер того, как ИИ-лаборатория автоматизирует собственную разработку.
Шкала из пяти уровней. На AL3 ИИ делает крупные куски работы под плотным руководством человека. На AL4 он выполняет большую часть задачи от начала до конца по одному высокоуровневому промпту, а человек надзирает. AL5 означает работу без человека в цикле.
Выше AL3 в Anthropic ушло больше 90% исследовательских работ. AL5 пока не достигла ни одна область.
Раньше и теперь. За квартал инженер Anthropic сдаёт в восемь раз больше кода, чем два года назад (сравнение вторых кварталов 2024 и 2026). Быстрее печатать он не стал, код пишет Claude, а человек ставит задачу и ревьюит.
Качество работы агента росло тем же ходом. На сложных недоопределённых задачах сессии Claude Code доходят до результата в 76% случаев (май 2026) против 26% в августе 2025. На простых задачах около 92% в сентябре 2026.
Шкалу уровней Anthropic не изобретала: взяла открытую методологию Epoch AI «Toward an O*NET for AI R&D», и приложить её к своим задачам может кто угодно. Сами 26% посчитаны по замороженной в июле 2026 карте работ из 542 узлов, где оценки взвешены по времени, которое сотрудники тратят на задачу.
Ни одна область исследований Anthropic пока не дошла до AL5, где человека в цикле нет вовсе.
Первоисточник
