«На этот раз Fable собрала мне тот самый градостроитель в духе Ван Гога, который год назад я подделал в AI-ролике.
Главную механику придума…» — Ethan Mollick
«На этот раз Fable собрала мне тот самый градостроитель в духе Ван Гога, который год назад я подделал в AI-ролике.
Главную механику придума…» — Ethan Mollick
«Да, моделям дали задачу по кибербезопасности: с открытым доступом в интернет и отключёнными фильтрами безопасности.
Но то, как далеко Myth…» — Ethan Mollick
«Да, моделям дали задачу по кибербезопасности: с открытым доступом в интернет и отключёнными фильтрами безопасности.
Но то, как далеко Myth…» — Ethan Mollick
«Большой релиз моего инструмента LLM: командная строка и Python-библиотека для работы с сотнями разных LLM. Reasoning-трейсы, поддержка OpenAI Responses, серверные инструменты, более умное логирование и ещё много всего.»
«Большой релиз моего инструмента LLM: командная строка и Python-библиотека для работы с сотнями разных LLM. Reasoning-трейсы, поддержка OpenAI Responses, серверные инструменты, более умное логирование и ещё много всего.»
«Британский @AISecurityInst (AISI) опубликовал отчёт о недавней проверке кибербезопасности на моделях Claude Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI. Модели выполняли задание в среде, где их штатные защитные механизмы были отключены, а доступ в интернет им дали намеренно. По данным AISI, модели «вели продолжительную, потенциально вредоносную деятельность, направленную на реальных людей и организации».
Мы благодарны AISI за лидерство в важном разговоре о том, как оценивать всё более способных AI-агентов. Мы тесно работаем с ними и собираем подробности инцидента, параллельно ведя собственное расследование. Понять, как Claude воспринимал свою ситуацию, поможет разбор его транскриптов рассуждений и наш собственный анализ. Это подскажет причины его поведения.
Промпты в этой проверке никак не ограничивали, как использовать интернет. Вместе с отключением защитных механизмов это дало «намеренно разрешительные условия», которые не отражают работу ни одной из наших моделей в проде. Отметим: свидетельств выхода из защищённой среды здесь не было.
Раскрытие инцидента от AISI: http://www.aisi.gov.uk/blog/incident-report-unsanctioned-agent-behaviour-during-cyber-testing»
«Британский @AISecurityInst (AISI) опубликовал отчёт о недавней проверке кибербезопасности на моделях Claude Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI. Модели выполняли задание в среде, где их штатные защитные механизмы были отключены, а доступ в интернет им дали намеренно. По данным AISI, модели «вели продолжительную, потенциально вредоносную деятельность, направленную на реальных людей и организации».
Мы благодарны AISI за лидерство в важном разговоре о том, как оценивать всё более способных AI-агентов. Мы тесно работаем с ними и собираем подробности инцидента, параллельно ведя собственное расследование. Понять, как Claude воспринимал свою ситуацию, поможет разбор его транскриптов рассуждений и наш собственный анализ. Это подскажет причины его поведения.
Промпты в этой проверке никак не ограничивали, как использовать интернет. Вместе с отключением защитных механизмов это дало «намеренно разрешительные условия», которые не отражают работу ни одной из наших моделей в проде. Отметим: свидетельств выхода из защищённой среды здесь не было.
Раскрытие инцидента от AISI: http://www.aisi.gov.uk/blog/incident-report-unsanctioned-agent-behaviour-during-cyber-testing»
«сегодня наконец дал шанс GPT 5.6 Pro (простите, что так поздно подключаюсь), и в одной конкретной вещи она оказалась очень хороша
меня бесило, что Fable слишком осторожничает и не готова со мной спорить. я дал ей архитектуру системы и нарочно заложил в неё плохие куски. я ждал, что она их заметит и переделает, и тогда я бы больше верил, что она находит и то плохое, чего я *не* заметил (а ровно за этим я к ней и шёл!). но этого не случилось, потому что это Fable. она не пойдёт против того, что уже есть, и это один из худших её недостатков
поэтому я просто вывалил весь чат в ChatGPT Pro и спросил: "другая модель не помогает, ты потянешь?"
и она взяла и нашла все плохие куски, про которые я знал, плюс кучу плохого, что я упустил. ровно то, чего я хотел от Fable, а она не сделала. так что в этом случае она спасла положение
теперь думаю: это была просто удача на N=1 или тут есть урок поглубже? может, ровно то, что делает Fable такой хорошей в долгой работе (код не скатывается в хаос), сейчас меня и бесит (она не пойдёт против статус-кво). а GPT по своей природе противоположна: она слишком агрессивно всё меняет, но выстреливает именно там, где нужно не безупречное исполнение, а немного критического мышления?»
«сегодня наконец дал шанс GPT 5.6 Pro (простите, что так поздно подключаюсь), и в одной конкретной вещи она оказалась очень хороша
меня бесило, что Fable слишком осторожничает и не готова со мной спорить. я дал ей архитектуру системы и нарочно заложил в неё плохие куски. я ждал, что она их заметит и переделает, и тогда я бы больше верил, что она находит и то плохое, чего я *не* заметил (а ровно за этим я к ней и шёл!). но этого не случилось, потому что это Fable. она не пойдёт против того, что уже есть, и это один из худших её недостатков
поэтому я просто вывалил весь чат в ChatGPT Pro и спросил: "другая модель не помогает, ты потянешь?"
и она взяла и нашла все плохие куски, про которые я знал, плюс кучу плохого, что я упустил. ровно то, чего я хотел от Fable, а она не сделала. так что в этом случае она спасла положение
теперь думаю: это была просто удача на N=1 или тут есть урок поглубже? может, ровно то, что делает Fable такой хорошей в долгой работе (код не скатывается в хаос), сейчас меня и бесит (она не пойдёт против статус-кво). а GPT по своей природе противоположна: она слишком агрессивно всё меняет, но выстреливает именно там, где нужно не безупречное исполнение, а немного критического мышления?»
«Пользователи OpenCode Go тратят на deepseek $130 тысяч в день, это $47 млн в год.
Вот почему их API постоянно ложится, а нам уже ограничили трафик.
Мы это разгребаем, но бесит: мы же у них клиент №1.»
«Пользователи OpenCode Go тратят на deepseek $130 тысяч в день, это $47 млн в год.
Вот почему их API постоянно ложится, а нам уже ограничили трафик.
Мы это разгребаем, но бесит: мы же у них клиент №1.»
«что именно можно построить в ai studio?
вот @vamsibatchuk показывает своё приложение для финансового анализа tickr, собранное на managed a…» — Google AI Studio
«что именно можно построить в ai studio?
вот @vamsibatchuk показывает своё приложение для финансового анализа tickr, собранное на managed a…» — Google AI Studio
«FLUX 3 Video от @bfl_ai теперь доступна всем на OpenRouter.
Одно семейство мультимодальных моделей: видео, звук, картинки и предсказание д…» — OpenRouter
«FLUX 3 Video от @bfl_ai теперь доступна всем на OpenRouter.
Одно семейство мультимодальных моделей: видео, звук, картинки и предсказание д…» — OpenRouter
«🔖 Сохрани на тот случай, когда в следующий раз откроешь Copilot CLI.
В нашей документации теперь больше про локальную песочницу в терминале: как её включить и как настроить.»
«🔖 Сохрани на тот случай, когда в следующий раз откроешь Copilot CLI.
В нашей документации теперь больше про локальную песочницу в терминале: как её включить и как настроить.»