OpenAI informuje, że Astra może zbliżać się do poziomu Critical w obszarze cyberbezpieczeństwa po tym, jak niewydany jeszcze model wygenerował 10 istotnych wyników z matematyki i wykazał szybki postęp w autonomicznej pracy nad zadaniami cybernetycznymi.
Kluczowe informacje:
- 7 sierpnia OpenAI ogłosiło, że nie może wykluczyć, iż Astra osiągnie zdolności cybernetyczne na poziomie Critical.
- Spółka wstrzymała część wewnętrznych prac nad Astrą, jednocześnie wzmacniając kontrolę bezpieczeństwa, środowiska sandbox oraz monitoring.
- Astra wygenerowała również 10 wyników badawczych rozwiązujących lub istotnie posuwających naprzód wieloletnie problemy z matematyki i informatyki teoretycznej.
Ryzyko cybernetyczne Astry
OpenAI poinformowało 7 sierpnia, że najnowsze wewnętrzne testy pokazały znaczący postęp w tzw. agentycznym kodowaniu oraz cyberbezpieczeństwie – na tyle duży, że firma nie jest już w stanie wykluczyć, iż Astra osiągnie poziom Critical według wewnętrznego Preparedness Framework. OpenAI nie twierdzi, że model już spełnia te kryteria; ocena ma nadal charakter wstępny.
Model zaklasyfikowany jako Critical w ramach tego podejścia mógłby autonomicznie tworzyć działające exploity typu zero‑day dla wielu dobrze zabezpieczonych, krytycznych systemów lub przeprowadzać nowe, kompletne łańcuchy ataków, wychodząc jedynie od ogólnego celu. OpenAI zapowiada zaostrzenie kontroli dostępu do sieci i narzędzi, lepszą ochronę wag modelu, szersze wykorzystanie szyfrowania i sandboxów oraz rozbudowę monitoringu agentycznych zastosowań Astry.
Spółka wstrzymała również te aktywności związane z Astrą, które jeszcze nie spełniają nowych, wyższych standardów zabezpieczeń, oraz zapowiedziała współpracę z agencjami rządowymi i wybranymi organizacjami zajmującymi się bezpieczeństwem AI przy dalszych testach. 1 sierpnia OpenAI opisywało Astrę jako „nasz kolejny przełomowy model”. 7 sierpnia ton został złagodzony – Astra została określona jako „jeden z naszych nadchodzących modeli”.
Zobacz także: Bitcoin blisko forka BIP-110 w ten weekend przy zaledwie 2,59% poparcia górników
Spór o wyniki z matematyki
Cybernetyczne ostrzeżenie pojawiło się po ujawnieniu, że wewnętrzna wersja Astry wygenerowała 10 wyników badawczych w takich dziedzinach jak złożoność kwantowa, kryptografia kratowa, teoria kodowania i kombinatoryka ekstremalna. Według OpenAI prace te rozwiązały lub znacząco posunęły naprzód wieloletnie otwarte problemy i wymagały około 2000 dolarów w tokenach, licząc według stawek API Sol.
Andrew Blumberg, profesor na Uniwersytecie Columbia i członek rady First Proof, powiedział w rozmowie z Mashable, że wyniki są imponujące, ale nie zmieniają jego oceny obecnych możliwości AI. Jak wskazał, wiele rezultatów ma formę zwięzłych kontrprzykładów lub „niewielkich, niezwykle pomysłowych konstrukcji” opartych na istniejącej literaturze. „Nie zmienia to moich wcześniejszych przekonań” – skomentował.
Mimo to rezultaty pokazują, że modele z czołówki rozwoju mogą stać się użytecznymi partnerami badawczymi, jednocześnie generując równoległe ryzyko – te same umiejętności kodowania mogą zostać wykorzystane do tworzenia skutecznych narzędzi ofensywnych w cyberprzestrzeni.
To napięcie coraz wyraźniej kształtuje podejście OpenAI do udostępniania i wdrażania kolejnych modeli.
Przed Astrą OpenAI oceniało model GPT‑5.6 Sol na poziomie High w zakresie cyberbezpieczeństwa, a nie Critical. Wcześniejszy system mógł pomagać w wyszukiwaniu luk i przygotowywaniu exploitów, ale – jak podkreśla OpenAI – nie wykazał on zdolności do niezawodnego, autonomicznego atakowania dobrze zabezpieczonych celów. Na tym tle najnowsza ocena Astry oznacza wyraźne podniesienie poprzeczki.
Czytaj dalej: Data premiery iPhone Fold wskazuje na 18 września, ale nie ma zgody co do terminu





