OpenAI тестирует систему безопасности, которая выявляет злоупотребления, не сохраняя данные клиентов. Это прямой вызов новому 30‑дневному правилу хранения данных у конкурента — Anthropic.
Ключевое
- OpenAI запустила превью Private Safety Processing — инструмента, который ищет признаки злоупотреблений в связанных сессиях, не сохраняя пользовательские запросы и ответы.
- Anthropic требует от корпоративных клиентов 30‑дневного хранения логов при использовании своих самых мощных моделей, утверждая, что это необходимо для выявления многоходовых атак.
- Масштабный запуск и технический белый документ ожидаются в сентябре.
Private Safety Processing против много-сессионных атак
Компания анонсировала превью в среду, представив его как развитие подхода Zero Data Retention — режима, при котором OpenAI не хранит запросы и ответы модели после обработки. Более широкий запуск и публикация технического доклада запланированы на сентябрь.
В новой архитектуре контент клиентов либо остается в инфраструктуре под их полным контролем, либо хранится у OpenAI в зашифрованном виде с использованием ключей, которыми владеет только заказчик. Автоматические системы анализируют эти данные на предмет злоупотреблений и подозрительных закономерностей в нескольких связанных сессиях. Подход распространяется и на агентные сценарии, когда система продолжает действовать после того, как пользователь формально остановил задачу. Сотрудники компании к этим данным доступа не получают.
Руководитель направления продуктовой политики Алия Хауз (Aleah Houze) заявила журналистам, что опасное поведение часто становится заметным только при анализе серии взаимодействий. В качестве примера она привела пользователя, который в одной сессии ищет уязвимости в ПО, а в другой — интересуется инструментами удаленного доступа.
Также по теме: Скрытый водяной знак Claude искажает искусство письма, считает Грубер
Правило хранения Anthropic обостряет конкуренцию
Anthropic в июле объявила о противоположном курсе: для корпоративных клиентов, использующих ее самые продвинутые модели, включая Fable 5 и Mythos 5, вводится обязательное 30‑дневное хранение данных.
В лаборатории признают, что политика непопулярна и может стоить ей части бизнеса, но считают логи критически важными для отслеживания атак, намеренно размазанных по множеству отдельных запросов. Человеческая проверка допускается, но только по строго регламентированной процедуре и для ограниченного круга уполномоченных ревизоров. Каждая сессия фиксируется в защищенном от подделки журнале.
Аналитики сомневаются в тайминге OpenAI и ждут доказательств
Исполнительный директор FormerGov Брайан Левин (Brian Levine) назвал инициативу сильным техническим обещанием: традиционно мониторинг злоупотреблений и «слепота» к содержанию данных находятся в прямом конфликте.
Он подчеркнул, что реальные доказательства появятся лишь спустя несколько недель. Джейсон Андерсен (Jason Andersen) из Moor Insights and Strategy расценил последние заявления во многом как расстановку акцентов перед возможным IPO.
Директор по информационной безопасности LexisNexis Risk Solutions Group Флавио Вильянустре (Flavio Villanustre) увидел в этом попытку смягчить будущие регуляторные требования, которые он считает неизбежными.
Превью завершает неделю, насыщенную месседжами о безопасности. Во вторник компания сообщила, что замедлила масштабирование и приостановила обучение с подкреплением, чтобы усилить защиту и провести дополнительное «красное командование» своей исследовательской среды. По оценкам OpenAI, расширенный мониторинг будет потреблять около 20% вычислительных ресурсов, задействованных в инференсе под наблюдением.
Читайте также: Bitcoin может снова превысить $100K до халвинга 2028 года, считает Скарамуччи





