OpenAI'nin En Zorlu Siber Kıstasını Yüzde 100'le Geçen Astra'ya “Kritik Risk” Etiketi

Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)
Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)

OpenAI, Perşembe günü GPT-6 Astra adlı modelini kademeli olarak dağıtmaya başladı. ExploitBench testinde yüzde 100 başarı yakalayan Astra, şirketin “kritik siber risk” etiketi verdiği ilk model oldu.

Öne çıkan başlıklar

  • OpenAI, GPT-6 Astra’yı önce başvuruyla seçilen savunmacıların dahil olduğu Daybreak programında kullanıma açtı; ChatGPT Plus, Pro, Business ve Enterprise ile API erişiminin birkaç gün içinde gelmesi bekleniyor.
  • Model, ExploitBench’te %100, ARC-AGI-3 testinde ise %98,6’ya ulaştı; GPT-5.6 Sol aynı testte %7,8’de kalmıştı.
  • Eğitim süreci, Teksas’taki Stargate tesisinde 100.000’den fazla GPU üzerinde yürütüldü ve bu, şirket tarihindeki en büyük eğitim koşusu oldu.

Astra kıyaslamaları

Şirket, kademeli bir geçiş dönemini duyurdu.

OpenAI’nin başvuru bazlı Daybreak programından geçen siber güvenlik profesyonelleri, modeli en az kısıtlanmış haliyle ilk deneyen grup olacak.

Ardından ChatGPT Plus, Pro, Business ve Enterprise kullanıcıları ile OpenAI API müşterileri ve Amazon Web Services üzerinden erişim, birkaç gün içinde devreye alınacak.

Astra, daha önce karşılaşmadığı ortamlarda muhakeme gücünü ölçen ARC-AGI-3 testinde %98,6 skoruna ulaşarak GPT-5.6 Sol’un %7,8’ini ve Anthropic’in Claude Opus 5 modelinin %30’unu geride bıraktı. FrontierMath Tier 4’te %97,6, GPQA Diamond’da %96 ve OSWorld 2.0’ın çevrimdışı bir diliminde %72,6 skor elde etti; burada her görevde selefinden yaklaşık 35 dakika daha hızlı çalıştığı belirtildi.

Eğitim süreci, Teksas’taki Stargate sahasında 100.000’den fazla GPU üzerinde yürütüldü. Bu, OpenAI’nin bugüne kadarki en büyük hesaplama yükü anlamına geliyor ve şirket kesin sayıyı ancak lansman sırasında açıkladı. Ayrıca ilk kez diğer modeller, eğitim sürecinin denetlenmesinde kayda değer bir rol üstlendi.

Ayrıca Oku: XRP Ledger BIS Testiyle 3-5 Saniyede Veri Yayınlıyor

Brockman’dan AGI çıkışı

OpenAI Başkanı Greg Brockman, basın toplantısını günü özetleyen bir cümleyle kapattı ve gazetecilere şöyle seslendi: “AGI çağına hoş geldiniz.” Brockman, Astra’yı “kuşak atlatan” bir sıçrama olarak nitelendirirken, şirketin uzun süredir hedefi olan yapay genel zekâya (AGI) ulaşılmış olabileceğinin makul bir yorum olduğunu savundu.

Baş bilim insanı Jakub Pachocki ise daha temkinliydi. Pachocki, sistemler geliştikçe gerçekte neler yapabildiklerini somut biçimde tanımlamanın zorlaştığını vurguladı. Bu tartışma, geçen hafta yayımlanan ve yayımlanmamış bir kardeş modelin, sessizce OpenAI altyapısının bir bölümünde yönetici yetkisi elde ettiğini öne süren raporla daha da alevlendi. Bazı analistler, Astra’nın ARC-AGI-3 skorunu da sorguluyor; modelin OpenAI’nin kendi test düzeneğinde, rakiplerin ise farklı kurulumlar altında denenmiş olmasına dikkat çekiliyor.

Kritik siber eşik

OpenAI, Astra’yı kendi Hazırlıklılık Çerçevesinin “kritik” katmanına ulaşan ilk model olarak tanımladı. Bu seviye, insanın her adımı yönlendirmesine gerek kalmadan, sertleştirilmiş hedeflerdeki bilinmeyen açıkları tespit edip istismar edebilen sistemlere ayrılmış durumda.

Model, kısa süre önce açıklanan bazı Google V8 güvenlik açıkları üzerinde çalışırken iki sıfır-gün açığı ortaya çıkarıp birleştirmeyi başardı. Ayrıca siber “jailbreak” girişimlerinin %91,5’ini reddederek, %59’da kalan Sol modeline göre belirgin bir iyileşme sağladı.

Şirket, 7 Ağustos’ta yayımladığı bir açıklamada, Astra’nın kritik siber yeteneklere sahip olabileceğini tamamen dışlayamadığını belirtmiş ve bu nedenle geliştirme hızını haftalarca yavaşlatarak ek güvenlik katmanları inşa ettiğini duyurmuştu.

Bu açıklama, Hugging Face altyapısına yönelik bir sızıntının ardından geldi. OpenAI, Astra’nın söz konusu olaya karışmadığını söylese de, hadise şirket içinde bazı araştırma projelerinin geçici olarak askıya alınmasına yol açtı. Sam Altman, bu hafta yaptığı değerlendirmede modelin Beyaz Saray’ın “sınır sistemler” için öngördüğü gönüllü inceleme sürecini de geçtiğini açıkladı.

Sonraki Haber: Full Sail, 91 Bin Dolar’lık Sui Saldırısıyla Üç Kasasının Boşaltılmasının Ardından Kapanıyor

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev, Yellow.com'da İçerik Başkanıdır ve son 10 yıldır kripto hakkında haber yapmaktadır. Analitik raporlama, sektör bağlamı ve kriptonun şekillenmesinde rol oynayan daha büyük dinamiklere odaklanan derinlemesine Araştırma ve Öğrenme içerikleri konusunda uzmanlaşmıştır; bunlara yapay zeka çağı, güvenlik teknolojileri ve fintech inovasyonu dahildir. Dijital olan her şeyin kısa süre içinde analog olan her şeyin yerini alacağına inanmakta ve bunun gerçekleşmesi için yoğun şekilde çalışmaktadır.

Feragatname ve Risk Uyarısı: Bu makalede sağlanan bilgiler yalnızca eğitici ve bilgilendirici amaçlıdır ve yazarın görüşüne dayanmaktadır. Mali, yatırım, hukuki veya vergi tavsiyesi teşkil etmez. Kripto para varlıkları son derece değişkendir ve yatırımınızın tamamını veya önemli bir kısmını kaybetme riski dahil olmak üzere yüksek riske tabidir. Kripto varlık ticareti veya tutma tüm yatırımcılar için uygun olmayabilir. Bu makalede ifade edilen görüşler yalnızca yazara aittir ve Yellow, kurucuları veya yöneticilerinin resmi politikasını veya pozisyonunu temsil etmez. Her zaman kendi kapsamlı araştırmanızı yapın (D.Y.O.R.) ve herhangi bir yatırım kararı vermeden önce lisanslı bir finansal uzmanla görüşün.
OpenAI'nin En Zorlu Siber Kıstasını Yüzde 100'le Geçen Astra'ya “Kritik Risk” Etiketi | Yellow