OpenAI випробовує систему безпеки, яка виявляє зловживання, не зберігаючи при цьому дані клієнтів, — фактичний виклик новому 30-денному правилу зберігання від Anthropic.
Головне:
- OpenAI запустила прев’ю Private Safety Processing — інструменту, що шукає шаблони зловживань у пов’язаних сесіях, не зберігаючи промпти та відповіді клієнтів.
- Anthropic вимагає від корпоративних користувачів своїх найпотужніших моделей 30-денного зберігання даних, вважаючи журнали критичними для виявлення багатокрокових атак.
- Масштабне розгортання та технічний white paper очікуються у вересні.
Private Safety Processing орієнтується на зловживання в кількох сесіях
Компанія оголосила про прев’ю в середу, представивши його як розширення Zero Data Retention — режиму, за якого OpenAI не зберігає промпти чи відповіді моделей після обробки запиту. Ширший запуск і технічний white paper заплановані на вересень.
За новою схемою вміст клієнта або лишається на інфраструктурі під його контролем, або зберігається в OpenAI у зашифрованому вигляді з ключами, якими володіє лише клієнт. Автоматизовані інструменти аналізують ці дані на предмет шаблонів зловживань між пов’язаними сесіями. Архітектура охоплює й агентну роботу, коли система може продовжувати дії вже після того, як користувач формально зупинив завдання. Персонал до вмісту доступу не має.
Алія Хауз (Aleah Houze), керівниця напряму продуктової політики, пояснила журналістам у коментарі для Axios, що небезпечна поведінка часто стає очевидною лише тоді, коли розглядати одразу кілька взаємодій. Вона навела приклад користувача, який в одній розмові зондує слабкі місця в ПЗ, а в іншій питає про інструменти для віддаленого доступу.
Читати також: Прихований водяний знак Claude спотворює мистецтво письма, вважає Грубер
Правило зберігання даних Anthropic загострює конкуренцію
Anthropic у липні представила протилежний підхід: для корпоративних клієнтів, що користуються її найпотужнішими моделями, включно з Fable 5 і Mythos 5, обов’язковими стали 30 днів зберігання логів.
Лабораторія визнала, що політика непопулярна і може вдарити по бізнесу, однак назвала журнали ключовим інструментом для виявлення атак, спеціально «розбитих» на багато окремих запитів. Людська перевірка залишається можливою, але лише через жорстко контрольований канал для обмеженого кола затверджених рев’юерів. Кожна сесія фіксується у журнал, захищений від маніпуляцій.
Аналітики сумніваються в часі й доказовій базі кроку OpenAI
Браян Левін (Brian Levine), виконавчий директор FormerGov, назвав у коментарі для Computerworld обіцянку OpenAI технічно сильною, адже моніторинг зловживань традиційно суперечив повній «сліпоті» до контенту.
Він зауважив, що реальні докази з’являться лише за кілька тижнів. Джейсон Андерсен (Jason Andersen) з Moor Insights and Strategy розцінив серію оголошень тижня як частину позиціонування перед можливим IPO.
Флавіо Вілланустре (Flavio Villanustre), директор з інформаційної безпеки LexisNexis Risk Solutions Group, побачив у кроці спробу пом’якшити очікувані регуляторні вимоги.
Прев’ю підсумувало тиждень, насичений меседжами про безпеку. У вівторок компанія заявила, що тимчасово сповільнила масштабування й призупинила навчання з підкріпленням, посилюючи захист і проводячи додаткове «редтімінг» дослідницького середовища. Вона також оцінила, що розширений моніторинг споживатиме близько 20% обчислювальних ресурсів для інференсу, які перебувають під наглядом.
Читайте далі: Bitcoin може знову сягнути $100 000 до халвінгу 2028 року, вважає Скарамуччі





