GPT-5.5 зрівнявся з Claude Mythos у 32-кроковій кібератаці, повідомляє британський AISI

GPT-5.5 reached parity with Claude Mythos by finishing AISI's 32-step corporate hack simulation autonomously, the U.K. agency reported Thursday (Image: Shutterstock)
GPT-5.5 reached parity with Claude Mythos by finishing AISI's 32-step corporate hack simulation autonomously, the U.K. agency reported Thursday (Image: Shutterstock)

Новітня модель OpenAI GPT-5.5 може автономно виконати ланцюжок із 32 кроків corporate network breach та розв’язати 12-годинну задачу з реверс-інжинірингу приблизно за 10 хвилин.

Результати кібероцінювання AISI

Британський Інститут безпеки ШІ (U.K. AI Security Institute), дослідницький підрозділ у складі Департаменту науки, інновацій і технологій, у четвер published результати своєї оцінки.

Дослідники з’ясували, що GPT-5.5 є лише другою моделлю, яка повністю розв’язала «The Last Ones» — багатостадійну симуляцію, створену разом із SpecterOps. Вона completed ланцюг у двох із десяти спроб.

Першою тест подолала Anthropic's Claude Mythos Preview, якій вдалося завершити три із десяти спроб. AISI оцінює, що людському експерту знадобилося б близько 20 годин, щоб пройти той самий kill chain через чотири підмережі та приблизно 20 хостів.

У завданнях рівня Expert GPT-5.5 scored показала 71,4% успішних виконань — трохи вище за Mythos Preview з 68,6% і значно вище за GPT-5.4 з 52,4%.

Також читайте: Why 75% Of Institutions Stay Bullish On Bitcoin Despite Coinbase's Mythos Warning

Ризик джейлбрейку та реакція на рівні політики

AISI виявив універсальний джейлбрейк, який обходив захисні механізми моделі для кожного шкідливого кіберзапиту, що тестувався. На розробку експлойта пішло шість годин роботи експертної red team, а проблема з конфігурацією завадила перевірити патч OpenAI.

Установа попередила, що наступальні кібернавички тепер, схоже, виникають як побічний продукт ширших покращень у міркуванні та автономності.

У квітні огляд AISI Mythos Preview marked the first time any frontier model finished the corporate attack у повному діапазоні end-to-end, тож GPT-5.5 розглядається як підтвердження тренду, а не як одноразовий стрибок.

Читайте далі: Crypto VC Funding Crashes To $659M In April, A 2-Year Low

Steven Zeiler profile photo

Steven Zeiler

Стівен Зайлер — головний євангеліст у компанії Yellow, де він співпрацює з розробниками над створенням реального часу, некостодіального торговельного інфраструктурного рішення з використанням Yellow SDK. Програміст, технолог і підприємець, раніше він працював у Ripple, де допомагав проєктувати прототипи однорангових міжбанківських платіжних систем і робив внесок у децентралізацію XRP Ledger за допомогою програмного забезпечення для відстеження консенсусу.

Відмова від відповідальності та попередження про ризики: Інформація, надана в цій статті, призначена лише для освітніх та інформаційних цілей і базується на думці автора. Вона не є фінансовою, інвестиційною, правовою чи податковою консультацією. Криптоактиви є надзвичайно волатильними та піддаються високому ризику, включаючи ризик втрати всіх або значної частини ваших інвестицій. Торгівля або утримання криптоактивів може не підходити для всіх інвесторів. Думки, висловлені в цій статті, належать виключно автору(ам) і не представляють офіційну політику чи позицію Yellow, її засновників або керівників. Завжди проводьте власне ретельне дослідження (D.Y.O.R.) та консультуйтесь з ліцензованим фінансовим фахівцем перед прийняттям будь-яких інвестиційних рішень.
Останні новини
Показати всі новини
Схожі новини
Схожі дослідницькі статті
Схожі навчальні матеріали
GPT-5.5 зрівнявся з Claude Mythos у 32-кроковій кібератаці, повідомляє британський AISI | Yellow