20 августа 2026 г.
OpenAI ищет угрозы, не читая переписку клиентов: наружу уходит только категория активности
Private Safety Processing уже в preview: контент клиента остаётся зашифрован его же ключами, а в OpenAI уходит только метка категории.

В одном диалоге спрашивают про уязвимости в ПО, в другом позже — про удалённый доступ. По отдельности обе пары промпт-ответ чисты.
Так объясняет замысел Aleah Houze, глава продуктовой политики OpenAI: «риски возникают не когда смотришь на одну пару промпт-ответ, а когда смотришь на множество взаимодействий во времени». Компания начала тестировать под это отдельный механизм, Private Safety Processing.
Выбор до сих пор был грубый. Либо провайдер хранит переписку и ищет в ней злоупотребления, либо клиент включает нулевое хранение и остаётся без всякого надзора. OpenAI разводит эти две вещи.
Наружу уходит метка. Автоматика ищет паттерны злоупотребления сразу по нескольким связанным взаимодействиям, а в OpenAI уезжает узкий сигнал с категорией активности, без промптов и ответов. Сам контент либо остаётся на инфраструктуре клиента, либо лежит у OpenAI зашифрованным ключами клиента, копий которых у персонала нет.
Механизм дают enterprise- и API-клиентам. На потребительских тарифах ChatGPT (Free, Plus, Go, Pro) правила хранения не меняются. Фидбек на разработке давали Microsoft, Databricks, Glean и Abridge.
Сейчас в API без нулевого хранения данных (ZDR) логи abuse monitoring живут до 30 дней. Само ZDR включается только после одобрения: сначала заявка в отдел продаж, потом переключатель в настройках организации. Assistants API, Threads, Vector stores и Conversations его не поддерживают вовсе, там хранение постоянное.
Anthropic пошла в обратную сторону. С 9 июня 2026 промпты и ответы её моделей класса Mythos хранятся 30 дней на всех платформах, и ZDR для них недоступен: организациям с нулевым хранением приходится включать хранение, иначе к этим моделям их не пустят. Причина у обеих компаний одна: атаки, которые видны только серией запросов.
Первоисточник