OpenAI informuje, że Astra może zbliżać się do poziomu „Critical” w ich wewnętrznej skali cyberbezpieczeństwa po tym, jak niewydany jeszcze model wygenerował 10 kluczowych wyników z matematyki i wykazał gwałtowny postęp w autonomicznej pracy nad cyberatakami oraz kodowaniem.
Najważniejsze informacje:
- 7 sierpnia OpenAI przyznało, że nie może wykluczyć, iż Astra osiągnie poziom „Critical” w zakresie cyberbezpieczeństwa.
- Firma wstrzymała część wewnętrznych prac nad Astrą, jednocześnie wzmacniając zabezpieczenia, środowiska testowe (sandboksy) i monitoring.
- Astra wygenerowała też 10 wyników badawczych, które rozwiązały lub istotnie posunęły do przodu wieloletnie problemy z matematyki i teoretycznej informatyki.
Ryzyko cybernetyczne Astry
7 sierpnia OpenAI poinformowało, że niedawne wewnętrzne testy pokazały znaczący postęp w tzw. „agentowym” programowaniu i cyberbezpieczeństwie – na tyle duży, że firma nie może już wykluczyć, iż Astra osiągnie poziom „Critical” w ramach ich Preparedness Framework. OpenAI nie twierdzi, że model już spełnia ten próg – ocena ma wciąż charakter wstępny.
Model zaklasyfikowany jako „Critical” w systemie OpenAI to taki, który potrafi samodzielnie opracowywać działające exploity typu zero‑day przeciwko wielu silnie utwardzonym systemom krytycznym lub przeprowadzać nowe, pełne łańcuchy ataków – od celu wysokiego poziomu po wykonanie techniczne. OpenAI zapowiada zaostrzenie dostępu do sieci i narzędzi, lepszą ochronę wag modelu, szersze szyfrowanie oraz agresywniejsze sandboxing, a także rozszerzenie monitoringu użycia Astry jako autonomicznego agenta.
Firma wstrzymała też te aktywności związane z Astrą, które nie spełniają jeszcze nowych, wyższych standardów zabezpieczeń, i zapowiada współpracę z agencjami rządowymi oraz wybranymi organizacjami zajmującymi się bezpieczeństwem AI przy dalszych testach. 1 sierpnia OpenAI opisywało Astrę jako „nasz następny główny model”. 7 sierpnia firma określiła ją już ostrożniej jako „jeden z naszych nadchodzących modeli”.
Zobacz też: Bitcoin blisko forka BIP-110 w ten weekend przy zaledwie 2,59% poparcia górników
Spór o matematykę
Ostrzeżenie dotyczące cyberbezpieczeństwa pojawiło się po ujawnieniu przez OpenAI, że wewnętrzna wersja Astry wygenerowała 10 wyników z obszarów takich jak złożoność kwantowa, kryptografia kratowa, teoria kodowania i kombinatoryka ekstremalna. Według OpenAI prace te rozwiązały lub istotnie posunęły naprzód długo otwarte problemy, a cały proces pochłonął ok. 2 000 dol. w tokenach przy stawkach API Sol.
Andrew Blumberg, profesor na Uniwersytecie Columbia i członek zarządu First Proof, powiedział w rozmowie z Mashable, że wyniki są imponujące, ale nie zmieniają jego oceny obecnych możliwości AI. Jak podkreśla, wiele z nich to zwięzłe kontrprzykłady lub „niewielkie, niezwykle sprytne konstrukcje” bazujące na znanej już literaturze. „Nie zmienia to moich wcześniejszych przekonań” – stwierdził.
Wyniki te pokazują jednak, że modele z czołówki rozwoju mogą stać się wartościowymi partnerami badawczymi, jednocześnie tworząc równoległy problem bezpieczeństwa, gdy te same umiejętności w programowaniu mogą zostać zastosowane do eksploatacji luk w oprogramowaniu.
Ta sprzeczność coraz mocniej wpływa na to, jak OpenAI podchodzi do oceny dostępu i wdrażania nowych modeli.
Przed Astrą OpenAI oceniało model GPT‑5.6 Sol na poziomie „High” w skali cyberbezpieczeństwa, a nie „Critical”. Ten wcześniejszy model potrafił pomagać w wykrywaniu podatności i zadaniach eksploatacyjnych, ale – jak twierdzi OpenAI – nie wykazywał niezawodnych, w pełni autonomicznych ataków na dobrze zabezpieczone cele. To sprawia, że najnowsza ocena Astry oznacza wyraźną eskalację.
Przeczytaj też: Data premiery iPhone Fold wskazuje na 18 września, ale nie wszyscy są zgodni





