OpenAI тестує систему безпеки, яка виявляє зловживання, не зберігаючи клієнтські дані, — прямий виклик новому правилу Anthropic щодо 30-денного зберігання.
Головне:
- OpenAI презентує Private Safety Processing — інструмент, що шукає патерни зловживань у пов’язаних сесіях, не зберігаючи запити й відповіді клієнтів.
- Anthropic вимагає від корпоративних користувачів своїх найпотужніших моделей 30-денного зберігання логів, називаючи їх критично важливими для виявлення багатокрокових атак.
- Масштабніший запуск та технічний white paper очікуються у вересні.
Private Safety Processing націлена на зловживання в кількох сесіях
Компанія повідомила про попередній запуск у середу, подавши його як розширення Zero Data Retention — режиму, за якого OpenAI не зберігає ані запитів, ані відповідей моделей після обробки. Ширший реліз і технічний white paper заплановані на вересень.
За новою схемою вміст клієнта або залишається в інфраструктурі, яку контролює сам замовник, або зберігається в OpenAI у зашифрованому вигляді з ключами, що належать лише клієнту. Автоматизовані інструменти аналізують ці дані на предмет патернів зловживань у пов’язаних сесіях. Архітектура також охоплює так звану агентну роботу, коли система може продовжувати діяти й після того, як користувач формально зупинив її. Співробітники до цього вмісту доступу не мають.
Алія Хауз, керівниця напряму продуктової політики компанії, заявила журналістам, що небезпечна поведінка часто проявляється лише тоді, коли дивитися на кілька взаємопов’язаних взаємодій одразу. Вона навела приклад користувача, який в одній розмові шукає слабкі місця в програмному забезпеченні, а в іншій — цікавиться інструментами віддаленого доступу.
Читайте також: Прихований водяний знак Claude спотворює ремесло письма, каже Ґрубер
Правило зберігання Anthropic загострює конкуренцію
Anthropic у липні запропонувала протилежний підхід: 30-денне зберігання даних для корпоративних клієнтів, які користуються її найпотужнішими моделями, включно з Fable 5 і Mythos 5.
У лабораторії визнали, що політика непопулярна й може вдарити по бізнесу, але назвали журнали доступу незамінним інструментом для виявлення атак, спеціально «розмазaних» по великій кількості окремих запитів. Людська перевірка залишається можливою, але лише через жорстко контрольований процес для невеликої групи затверджених рев’юерів. Кожна сесія фіксується у захищеному від підробки журналі.
Аналітики ставлять під сумнів таймінг і докази від OpenAI
Браян Левайн, виконавчий директор FormerGov, назвав обіцянку серйозним технічним зобов’язанням, адже історично моніторинг зловживань і «сліпота» до контенту тягнули систему в різні боки.
Він зауважив, що реальні докази з’являться лише за кілька тижнів. Джейсон Андерсен з Moor Insights and Strategy частково розцінив оголошення цього тижня як позиціонування перед можливим IPO.
Флавіо Вілланустре, директор із інформаційної безпеки LexisNexis Risk Solutions Group, побачив у кроці спробу пом’якшити майбутнє регулювання, якого він очікує.
Попередній запуск завершує тиждень, насичений меседжами про безпеку. У вівторок компанія заявила, що сповільнила нарощування масштабів і призупинила навчання з підкріпленням, аби посилити захист і провести «red-teaming» свого дослідницького середовища. В OpenAI також оцінили, що розширений моніторинг споживатиме близько 20% інференс-потужностей, що перебувають під наглядом.
Читайте далі: Bitcoin може знову взяти $100 тис. до халвінгу 2028 року, каже Скарамуччі





