OpenAI тестирует систему безопасности, которая выявляет злоупотребления без сохранения данных клиентов — прямой вызов новой 30‑дневной политике хранения у конкурента Anthropic.
Ключевые моменты:
- OpenAI запускает в превью Private Safety Processing — инструмент, который ищет паттерны злоупотреблений в связанных сессиях, не сохраняя пользовательские запросы и ответы.
- Anthropic требует от корпоративных клиентов 30‑дневного хранения данных при работе с самыми мощными моделями, утверждая, что логи необходимы для отслеживания многошаговых атак.
- Масштабный запуск и технический white paper намечены на сентябрь.
Private Safety Processing нацелен на злоупотребления в нескольких сессиях
Компания объявила о превью в среду, представив его как развитие инициативы Zero Data Retention — соглашения, по которому OpenAI не хранит запросы и ответы моделей после обработки запроса. Более широкий запуск и публикация технического документа запланированы на сентябрь.
По новой схеме контент клиентов либо остается в инфраструктуре, которую контролирует сам заказчик, либо хранится у OpenAI в зашифрованном виде с ключами, которые находятся исключительно у клиента. Автоматизированные инструменты анализируют этот контент на предмет паттернов злоупотреблений в связанных сессиях. Архитектура учитывает и «агентное» поведение — когда система продолжает действовать после того, как пользователь формально завершил сессию. Сотрудники компании к этим данным не допускаются.
Алиа Хауз (Aleah Houze), руководитель направления продуктовой политики в OpenAI, заявила в беседе с журналистами (ссылка), что опасные модели поведения часто становятся заметны только при анализе сразу нескольких взаимодействий. В пример она привела пользователя, который в одной сессии изучает уязвимости ПО, а в другой — интересуется инструментами удаленного доступа.
Читайте также: Скрытый водяной знак Claude искажает ремесло письма, считает Грубер
Правило хранения данных Anthropic расчерчивает линию между конкурентами
Anthropic в июле обозначила противоположный подход: 30‑дневное обязательное хранение данных для корпоративных клиентов, использующих ее самые мощные модели, включая Fable 5 и Mythos 5.
В лаборатории признают, что эта политика может оказаться непопулярной и ударить по бизнесу, но называют логи критически важными для отслеживания атак, намеренно «растянутых» на множество отдельных запросов. Ручная проверка по‑прежнему возможна, но только по строго регламентированному каналу, открытому ограниченному числу одобренных ревьюеров. Каждая сессия фиксируется в защищенном от подделки журнале.
Аналитики сомневаются во времени анонса и доказательствах OpenAI
Брайан Левин (Brian Levine), исполнительный директор FormerGov, назвал (ссылка) инициативу сильным техническим обещанием, поскольку мониторинг злоупотреблений и «слепота» к содержанию исторически идут вразрез друг с другом.
Он обратил внимание, что реальные доказательства последуют лишь через несколько недель. Джейсон Андерсен (Jason Andersen) из Moor Insights and Strategy частично трактует недавние анонсы как позиционирование перед возможным IPO.
Флавио Вилланустре (Flavio Villanustre), директор по информационной безопасности LexisNexis Risk Solutions Group, видит в инициативе попытку смягчить будущие регуляторные требования, которые он считает неизбежными.
Превью завершает неделю, насыщенную заявлениями о безопасности. Во вторник компания сообщила, что замедлила масштабирование и приостановила обучение с подкреплением, чтобы усилить защиту исследовательской среды и подвергнуть ее дополнительному «красному тимингу». OpenAI также оценивает, что расширенный мониторинг будет потреблять примерно 20% вычислительных ресурсов для инференса, находящихся под наблюдением.
Читайте далее: Bitcoin может вновь превысить $100 тыс. до халвинга 2028 года, считает Скарамуччи





