./новости · 29 июля 2026 г.
новость
Требования к AI-продукту теперь пишут прогонами: «evals - это новые PRD» от главы продукта Anthropic
источник: @lennysan · X·
машинная выжимка · сверена с источником

Lenny Rachitsky
@lennysan
Глава продукта по AI-research в Anthropic: evals - это новые PRD
Дианн Пенн - глава продукта по research и Labs в @AnthropicAI. Она пришла в 2023-м первым техническим PM, когда продуктовых инженеров было всего пятеро, и приложила руку к каждой модели Claude, от Claude 2 до Mythos. О чём говорим: 02:31 Ранние годы Anthropic 08:55 Два главных перелома 13:50 Внутри экспоненты 20:02 Token maxing 23:30 Anthropic Labs и модель инкубации 27:30 Как устроена роль AI-research 31:35 Как стать топовым AI-исследователем 35:18 Защитные механизмы фронтир-моделей 39:38 Найм в эпоху AI 44:16 Как строить evals 47:48 Evals - это новые PRD 49:55 Важность
· 4,4 тыс. просмотров
29 июля Дианн Пенн из Anthropic сказала: evals - это новые PRD. Она пришла в компанию в 2023-м первым техническим PM, когда продуктовых инженеров было пятеро, и вела каждую модель Claude от Claude 2 до Mythos. В выпуске подкаста Ленни Рачитски теме отданы два блока: 44:16 про то, как строить evals, и 47:48 про сам тезис.
Почему это важно: Раньше продукт начинался с PRD: продакт писал документ с требованиями, инженеры сверяли готовое с текстом. Пенн говорит, что эту роль забирают evals - наборы прогонов, на которых модель либо держит нужное поведение, либо нет. Разница рабочая: текстовое требование к вероятностной модели нельзя ни принять, ни отклонить, а прогон даёт число на каждой сборке. Как именно Anthropic собирает такие наборы, в анонсе нет ни строчки: только два таймкода.
Что дальше: Возьми последний свой PRD и перепиши один пункт как проверяемый прогон с порогом. Пункт, который не превращается в замер, не работал и раньше.
первоисточник
