28 сентября 2026 г.
Код ИИ-агентов проверяют не построчно: DHH ставит на тесты и ИИ-ревью
28 сентября DHH связал путь от промпта до прода с автоматическими тестами и ревью ИИ-агентов, а не с ручной проверкой каждой строки. Один агент ищет ошибки в изменениях другого, человек выборочно смотрит результат.

DHH
@dhh
Нужно время, чтобы обрести уверенность, но будущего, в котором вы вручную проверяете каждую строку кода от агентов, нет. Так сильно не разгонишься. Нужны ИИ-агенты, которые проверяют работу других агентов с позиции оппонента, нужны автоматические тесты, и, возможно, выборочная проверка. Вот и всё. От промпта до прода!
· 61,8 тыс. просмотров
7 января DHH описывал команду агентов, которая работает автономно, пока он проверяет итог, и считал чистый вайбкодинг в профессиональной работе пока целью. Теперь он переносит контроль раньше: один ИИ-агент ищет ошибки в работе другого, а тесты проверяют результат.
Ревьюер рядом. OpenCode ставится командой `curl -fsSL https://opencode.ai/v2/install | bash` и на 28 сентября поддерживает 75+ LLM-провайдеров и нескольких агентов в одном проекте. Read-only reviewer создают в `.opencode/agents/reviewer.md`, дают ему `mode: subagent` и запрещают `edit` и `shell`, затем основной агент получает команду `Use the reviewer subagent to review my current changes.`
В Codex Auto-review включают `approval_policy = "on-request"` и `approvals_reviewer = "auto_review"`. Отдельный агент проверяет запросы на выход за sandbox, не получая дополнительных прав на сеть или запись.
Препринт ABTest на arXiv от 3 апреля нашёл 1 573 аномалии в 647 repository-grounded fuzzing-кейсах для Claude Code, Codex CLI и Gemini CLI, 642 из них подтвердили вручную. Полевое исследование 37 623 PR из 2 807 репозиториев от 12 сентября зафиксировало revert у Codex в 6,1% PR против 11,5% у человеческого baseline и 14,5% у Devin.
Следующим узким местом станут тесты и агенты-рецензенты, которые ловят ошибку до прода.
Первоисточник
