«Я опубликовал новую универсальную спецификацию для терминалов. С её помощью любая программа может сообщить терминалу, что она делает: простаивает, работает, ждёт, завершилась или завершилась с ошибкой, и почему. Реализовать её легко с обеих сторон. Подробнее о том, зачем она нужна: https://mitchellh.com/writing/program-status-osc7501
Проблема общая, и её решение пригодится во множестве сценариев, например в менеджерах пакетов и инструментах сборки. Но особенно уродливо она проявляется в работе с ИИ, когда нужно собрать в одном месте агентов, которым требуется внимание.
Я нашёл свыше 250 разных оркестраторов агентов с разными задачами. Каждый самостоятельно пытается по косвенным признакам определить, работают ли инструменты вроде Claude Code, застряли ли они, закончили ли задачу и так далее.
В истории коммитов @herdrdev можно найти около 10 правок совместимости для распознавания Claude Code только за последние 3 месяца. (Это не выпад в адрес Herdr! Они отлично работают с тем, что есть, и все остальные делают то же самое).
Эвристики не выход. И зацикливаться на агентах тоже не стоит: задача интересна и для других инструментов, таких как Homebrew, Terraform, Cargo и так далее.
Проприетарные протоколы и отдельные API тоже не выход. Число необходимых интеграций у них растёт как O(N), а для работы через SSH, в локальных виртуальных машинах и контейнерах приходится прикладывать дополнительные усилия.
Спецификация состояния программы OSC 7501 решает эту задачу надёжно и детерминированно. Она универсальна, и её легко внедрить во всей отрасли.
Подробнее: https://mitchellh.com/writing/program-status-osc7501»
«Я опубликовал новую универсальную спецификацию для терминалов. С её помощью любая программа может сообщить терминалу, что она делает: простаивает, работает, ждёт, завершилась или завершилась с ошибкой, и почему. Реализовать её легко с обеих сторон. Подробнее о том, зачем она нужна: https://mitchellh.com/writing/program-status-osc7501
Проблема общая, и её решение пригодится во множестве сценариев, например в менеджерах пакетов и инструментах сборки. Но особенно уродливо она проявляется в работе с ИИ, когда нужно собрать в одном месте агентов, которым требуется внимание.
Я нашёл свыше 250 разных оркестраторов агентов с разными задачами. Каждый самостоятельно пытается по косвенным признакам определить, работают ли инструменты вроде Claude Code, застряли ли они, закончили ли задачу и так далее.
В истории коммитов @herdrdev можно найти около 10 правок совместимости для распознавания Claude Code только за последние 3 месяца. (Это не выпад в адрес Herdr! Они отлично работают с тем, что есть, и все остальные делают то же самое).
Эвристики не выход. И зацикливаться на агентах тоже не стоит: задача интересна и для других инструментов, таких как Homebrew, Terraform, Cargo и так далее.
Проприетарные протоколы и отдельные API тоже не выход. Число необходимых интеграций у них растёт как O(N), а для работы через SSH, в локальных виртуальных машинах и контейнерах приходится прикладывать дополнительные усилия.
Спецификация состояния программы OSC 7501 решает эту задачу надёжно и детерминированно. Она универсальна, и её легко внедрить во всей отрасли.
Подробнее: https://mitchellh.com/writing/program-status-osc7501»
«Команда Every старается поручать агентам как можно больше работы. Чтобы при выходе новой модели вся команда могла делиться навыками, они со…» — Claude
«Команда Every старается поручать агентам как можно больше работы. Чтобы при выходе новой модели вся команда могла делиться навыками, они со…» — Claude
«Пусть ваше приложение выбирает нужную модель, инструмент или действие почти в реальном времени с Decisions API, который теперь доступен все…» — OpenAI Developers
«Пусть ваше приложение выбирает нужную модель, инструмент или действие почти в реальном времени с Decisions API, который теперь доступен все…» — OpenAI Developers
«Я применил к Codex правило «собирать операции ввода-вывода в одну блокирующую задачу Tokio» и получил огромное ускорение в ряде типичных ра…» — Charlie Marsh
«Я применил к Codex правило «собирать операции ввода-вывода в одну блокирующую задачу Tokio» и получил огромное ускорение в ряде типичных ра…» — Charlie Marsh
«Меня удивляет, что люди удивляются тому, как я пишу промпты для Claude.
Говорите с Claude так, как говорили бы с коллегой. Никакого секрета в промптах нет. Для большинства задач не нужно задавать сложную структуру или подробно расписывать каждый шаг — дайте Claude цель, и он сам разберётся.
Во времена Sonnet 3.5 ваш промпт многое решал. Сейчас гораздо важнее объяснить модели:
1. Что вы хотите поручить ей
2. Сколько усилий она должна потратить
3. Как ей проверить, что она всё сделала правильно»
«Меня удивляет, что люди удивляются тому, как я пишу промпты для Claude.
Говорите с Claude так, как говорили бы с коллегой. Никакого секрета в промптах нет. Для большинства задач не нужно задавать сложную структуру или подробно расписывать каждый шаг — дайте Claude цель, и он сам разберётся.
Во времена Sonnet 3.5 ваш промпт многое решал. Сейчас гораздо важнее объяснить модели:
1. Что вы хотите поручить ей
2. Сколько усилий она должна потратить
3. Как ей проверить, что она всё сделала правильно»
«Mistral Large 4 набрала 62% на DeepSWE и обошла GLM-5.3, по данным VentureBeat.
Также она набрала 67% на Finch: задачи по финансам, лучший…» — 🚨 AI News | TestingCatalog
«Mistral Large 4 набрала 62% на DeepSWE и обошла GLM-5.3, по данным VentureBeat.
Также она набрала 67% на Finch: задачи по финансам, лучший…» — 🚨 AI News | TestingCatalog
«Если вы живёте в терминале, это для вас.
Посмотрите, как в Codex CLI задавать задачи голосом, управлять агентами в разных проектах и пробо…» — OpenAI Developers
«Если вы живёте в терминале, это для вас.
Посмотрите, как в Codex CLI задавать задачи голосом, управлять агентами в разных проектах и пробо…» — OpenAI Developers
«Мы расширяем Cyber Verification Program, чтобы предоставить специалистам по безопасности более широкий доступ к нашим наиболее способным моделям.
Через эту программу проверенные специалисты по безопасности могут получить доступ к Claude Mythos 5.1, Opus 5.5 и Sonnet 5.5 с ограничителями, рассчитанными на защитные задачи.
Мы также добавляем новые уровни доступа для разрешённых атак, включая тесты на проникновение и red-teaming.
https://www.anthropic.com/news/cyber-verification-program»
«Мы расширяем Cyber Verification Program, чтобы предоставить специалистам по безопасности более широкий доступ к нашим наиболее способным моделям.
Через эту программу проверенные специалисты по безопасности могут получить доступ к Claude Mythos 5.1, Opus 5.5 и Sonnet 5.5 с ограничителями, рассчитанными на защитные задачи.
Мы также добавляем новые уровни доступа для разрешённых атак, включая тесты на проникновение и red-teaming.
https://www.anthropic.com/news/cyber-verification-program»
«GOOGLE 🔥: Nano Banana 2.1 появляется в Google AI Studio, API и Gemini!
> «Модель для качественной генерации и редактирования изображений:…» — 🚨 AI News | TestingCatalog
«GOOGLE 🔥: Nano Banana 2.1 появляется в Google AI Studio, API и Gemini!
> «Модель для качественной генерации и редактирования изображений:…» — 🚨 AI News | TestingCatalog
«AgentMail запустила AgentID — способ входа, с которым ИИ-агенты могут заходить в приложения по подтверждённой почте, как люди через кнопку…» — 🚨 AI News | TestingCatalog
«AgentMail запустила AgentID — способ входа, с которым ИИ-агенты могут заходить в приложения по подтверждённой почте, как люди через кнопку…» — 🚨 AI News | TestingCatalog
«За последние недели я перенёс значительную часть сложных задач из Cowork в новые Claude Projects (название сбивает с толку: это не те прежние Projects в Claude, а постоянный чат с выделенной облачной виртуальной машиной). По моему опыту, они гораздо лучше в большинстве отношений, но документация недостаточно понятная.»
«За последние недели я перенёс значительную часть сложных задач из Cowork в новые Claude Projects (название сбивает с толку: это не те прежние Projects в Claude, а постоянный чат с выделенной облачной виртуальной машиной). По моему опыту, они гораздо лучше в большинстве отношений, но документация недостаточно понятная.»
«Как понять, находит ли ИИ-ревьюер важные проблемы в коде и не добавляет ли лишних замечаний?
ReviewBench — новый открытый бенчмарк: мы разработали его на основе анализа 103,9 млн pull requests на GitHub и включили 219 pull requests на 19 языках программирования.
Подключите своего агента для ревью кода, оцените его и отправьте результаты ⬇️
https://github.blog/ai-and-ml/github-copilot/reviewbench-an-open-benchmark-for-ai-code-review/?utm_source=x-promoting-reviewbench-blog-article&utm_medium=social&utm_campaign=reviewbenchmark-oct-2026»
«Как понять, находит ли ИИ-ревьюер важные проблемы в коде и не добавляет ли лишних замечаний?
ReviewBench — новый открытый бенчмарк: мы разработали его на основе анализа 103,9 млн pull requests на GitHub и включили 219 pull requests на 19 языках программирования.
Подключите своего агента для ревью кода, оцените его и отправьте результаты ⬇️
https://github.blog/ai-and-ml/github-copilot/reviewbench-an-open-benchmark-for-ai-code-review/?utm_source=x-promoting-reviewbench-blog-article&utm_medium=social&utm_campaign=reviewbenchmark-oct-2026»
«Мы упрощаем условия получения повышенных лимитов запросов к OpenAI API.
Вместо пяти платных уровней использования будет три: Build, Launch…» — OpenAI Developers
«Мы упрощаем условия получения повышенных лимитов запросов к OpenAI API.
Вместо пяти платных уровней использования будет три: Build, Launch…» — OpenAI Developers
«Признаю, работа над gbrain у меня организована несколько хаотично. Приходит баг или проблема — я запускаю отдельную сессию, чтобы разобрать…» — Garry Tan
«Признаю, работа над gbrain у меня организована несколько хаотично. Приходит баг или проблема — я запускаю отдельную сессию, чтобы разобрать…» — Garry Tan
«Вы знали, что можно попросить Bolt подключить @Sentry с соблюдением GDPR? Сетевые адреса не сохраняются, вместо email используются внутренн…» — bolt.new
«Вы знали, что можно попросить Bolt подключить @Sentry с соблюдением GDPR? Сетевые адреса не сохраняются, вместо email используются внутренн…» — bolt.new
«Ampersand привлекла $15 млн в раунде Series A под руководством Bessemer Venture Partners, объявила общий доступ к платформе, а Лори Мур вой…» — 🚨 AI News | TestingCatalog
«Ampersand привлекла $15 млн в раунде Series A под руководством Bessemer Venture Partners, объявила общий доступ к платформе, а Лори Мур вой…» — 🚨 AI News | TestingCatalog
«Вчера за ужином с Томом Брауном, Томом Бломфилдом и Полом Грэмом я с помощью Opus 5.5 в быстром режиме реализовал Doom на Bel, варианте Lis…» — Garry Tan
«Вчера за ужином с Томом Брауном, Томом Бломфилдом и Полом Грэмом я с помощью Opus 5.5 в быстром режиме реализовал Doom на Bel, варианте Lis…» — Garry Tan
«На GitHub за месяц уже появляется больше PR, сгенерированных ИИ, чем написанных людьми.
Сейчас за месяц появляется примерно в 3 раза больше PR, сгенерированных ИИ, чем люди писали за месяц в конце 2023 года, например в декабре.
Подумайте, что всё это значит (мы знали, что к этому придёт, но теперь это уже произошло)»
«На GitHub за месяц уже появляется больше PR, сгенерированных ИИ, чем написанных людьми.
Сейчас за месяц появляется примерно в 3 раза больше PR, сгенерированных ИИ, чем люди писали за месяц в конце 2023 года, например в декабре.
Подумайте, что всё это значит (мы знали, что к этому придёт, но теперь это уже произошло)»