OpenAI Astra podnosi alarm cyberbezpieczeństwa po 10 przełomowych wynikach z matematyki

New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)

OpenAI informuje, że Astra może zbliżać się do poziomu „Critical” w ich wewnętrznej skali cyberbezpieczeństwa po tym, jak niewydany jeszcze model wygenerował 10 kluczowych wyników z matematyki i wykazał gwałtowny postęp w autonomicznej pracy nad cyberatakami oraz kodowaniem.

Najważniejsze informacje:

  • 7 sierpnia OpenAI przyznało, że nie może wykluczyć, iż Astra osiągnie poziom „Critical” w zakresie cyberbezpieczeństwa.
  • Firma wstrzymała część wewnętrznych prac nad Astrą, jednocześnie wzmacniając zabezpieczenia, środowiska testowe (sandboksy) i monitoring.
  • Astra wygenerowała też 10 wyników badawczych, które rozwiązały lub istotnie posunęły do przodu wieloletnie problemy z matematyki i teoretycznej informatyki.

Ryzyko cybernetyczne Astry

7 sierpnia OpenAI poinformowało, że niedawne wewnętrzne testy pokazały znaczący postęp w tzw. „agentowym” programowaniu i cyberbezpieczeństwie – na tyle duży, że firma nie może już wykluczyć, iż Astra osiągnie poziom „Critical” w ramach ich Preparedness Framework. OpenAI nie twierdzi, że model już spełnia ten próg – ocena ma wciąż charakter wstępny.

Model zaklasyfikowany jako „Critical” w systemie OpenAI to taki, który potrafi samodzielnie opracowywać działające exploity typu zero‑day przeciwko wielu silnie utwardzonym systemom krytycznym lub przeprowadzać nowe, pełne łańcuchy ataków – od celu wysokiego poziomu po wykonanie techniczne. OpenAI zapowiada zaostrzenie dostępu do sieci i narzędzi, lepszą ochronę wag modelu, szersze szyfrowanie oraz agresywniejsze sandboxing, a także rozszerzenie monitoringu użycia Astry jako autonomicznego agenta.

Firma wstrzymała też te aktywności związane z Astrą, które nie spełniają jeszcze nowych, wyższych standardów zabezpieczeń, i zapowiada współpracę z agencjami rządowymi oraz wybranymi organizacjami zajmującymi się bezpieczeństwem AI przy dalszych testach. 1 sierpnia OpenAI opisywało Astrę jako „nasz następny główny model”. 7 sierpnia firma określiła ją już ostrożniej jako „jeden z naszych nadchodzących modeli”.

Zobacz też: Bitcoin blisko forka BIP-110 w ten weekend przy zaledwie 2,59% poparcia górników

Spór o matematykę

Ostrzeżenie dotyczące cyberbezpieczeństwa pojawiło się po ujawnieniu przez OpenAI, że wewnętrzna wersja Astry wygenerowała 10 wyników z obszarów takich jak złożoność kwantowa, kryptografia kratowa, teoria kodowania i kombinatoryka ekstremalna. Według OpenAI prace te rozwiązały lub istotnie posunęły naprzód długo otwarte problemy, a cały proces pochłonął ok. 2 000 dol. w tokenach przy stawkach API Sol.

Andrew Blumberg, profesor na Uniwersytecie Columbia i członek zarządu First Proof, powiedział w rozmowie z Mashable, że wyniki są imponujące, ale nie zmieniają jego oceny obecnych możliwości AI. Jak podkreśla, wiele z nich to zwięzłe kontrprzykłady lub „niewielkie, niezwykle sprytne konstrukcje” bazujące na znanej już literaturze. „Nie zmienia to moich wcześniejszych przekonań” – stwierdził.

Wyniki te pokazują jednak, że modele z czołówki rozwoju mogą stać się wartościowymi partnerami badawczymi, jednocześnie tworząc równoległy problem bezpieczeństwa, gdy te same umiejętności w programowaniu mogą zostać zastosowane do eksploatacji luk w oprogramowaniu.

Ta sprzeczność coraz mocniej wpływa na to, jak OpenAI podchodzi do oceny dostępu i wdrażania nowych modeli.

Przed Astrą OpenAI oceniało model GPT‑5.6 Sol na poziomie „High” w skali cyberbezpieczeństwa, a nie „Critical”. Ten wcześniejszy model potrafił pomagać w wykrywaniu podatności i zadaniach eksploatacyjnych, ale – jak twierdzi OpenAI – nie wykazywał niezawodnych, w pełni autonomicznych ataków na dobrze zabezpieczone cele. To sprawia, że najnowsza ocena Astry oznacza wyraźną eskalację.

Przeczytaj też: Data premiery iPhone Fold wskazuje na 18 września, ale nie wszyscy są zgodni

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev jest szefem działu treści w Yellow.com i od 10 lat zajmuje się reportażem na temat kryptowalut. Specjalizuje się w pogłębionych materiałach typu Research i Learn, koncentrując się na analizie, kontekście branżowym oraz większych siłach kształtujących świat krypto – od ery AI i technologii bezpieczeństwa po innowacje w fintechu. Wierzy, że wszystko, co cyfrowe, wkrótce całkowicie zdominuje to, co analogowe, i ciężko pracuje, aby tak się stało.

Zastrzeżenie i ostrzeżenie o ryzyku: Informacje zawarte w tym artykule służą wyłącznie celom edukacyjnym i informacyjnym i opierają się na opinii autora. Nie stanowią one porad finansowych, inwestycyjnych, prawnych czy podatkowych. Aktywa kryptowalutowe są bardzo zmienne i podlegają wysokiemu ryzyku, w tym ryzyku utraty całości lub znacznej części Twojej inwestycji. Handel lub posiadanie aktywów krypto może nie być odpowiednie dla wszystkich inwestorów. Poglądy wyrażone w tym artykule są wyłącznie poglądami autora/autorów i nie reprezentują oficjalnej polityki lub stanowiska Yellow, jej założycieli lub dyrektorów. Zawsze przeprowadź własne dokładne badania (D.Y.O.R.) i skonsultuj się z licencjonowanym specjalistą finansowym przed podjęciem jakiejkolwiek decyzji inwestycyjnej.