OpenAI'nin En Zorlu Siber Testinde Yüzde 100 Alan Astra, Kritik Risk Sınıfına Geçti

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI, perşembe günü GPT-6 Astra için kademeli dağıtıma başladı. ExploitBench’te yüzde 100’lük “mükemmel” skor alan Astra, şirketin kendi çerçevesinde ilk kez “kritik siber risk” etiketi verdiği model oldu.

Öne Çıkanlar

  • OpenAI, GPT-6 Astra’yı perşembe günü önce başvuruyla seçilen savunmacıların yer aldığı Daybreak programında devreye aldı; ChatGPT Plus, Pro, Business ve Enterprise kullanıcıları ile API erişimi ise birkaç gün içinde açılacak.
  • Model, ExploitBench’te yüzde 100, ARC-AGI-3’te ise yüzde 98,6 skor elde etti; aynı testte GPT-5.6 Sol’un skoru yüzde 7,8’de kalmıştı.
  • Eğitim, Texas’taki Stargate sahasında 100.000’den fazla GPU üzerinde yürütüldü ve şirkete göre bugüne kadarki en büyük eğitim koşusu oldu.

Astra’nın Benchmark Sonuçları

Şirket, Astra için kademeli bir çıkış planı benimsedi.

OpenAI’nin başvuru esaslı Daybreak programı üzerinden doğrulanmış siber güvenlik savunmacıları, modele ilk erişen grup ve en az kısıtlamayla çalışan sürümü kullanıyor.

Bunu, birkaç gün içinde ChatGPT Plus, Pro, Business ve Enterprise aboneleri, OpenAI API müşterileri ve Amazon Web Services entegrasyonu takip edecek.

Astra, daha önce görmediği senaryolarda akıl yürütme kabiliyetini ölçen ARC-AGI-3 testinde yüzde 98,6’lık skor elde etti. Aynı testte GPT-5.6 Sol yüzde 7,8’de, Anthropic imzalı Claude Opus 5 ise yüzde 30 seviyesinde kalmıştı. Model ayrıca FrontierMath Tier 4’te yüzde 97,6, GPQA Diamond’da yüzde 96 ve OSWorld 2.0’ın çevrimdışı bir bölümünde yüzde 72,6 skor elde etti; burada önceki nesle kıyasla görev başına yaklaşık 35 dakika daha hızlı çalıştı.

Eğitim süreci, Texas’taki Stargate tesisinde 100.000’in üzerinde GPU kullanılarak yürütüldü. Bu, OpenAI’nin bugüne dek denediği en büyük eğitim koşusu olarak açıklandı ve kullanılan hesaplama gücü ilk kez lansmanla birlikte resmen duyuruldu. Aynı zamanda, diğer yapay zeka modellerinin de eğitimi denetlemede kayda değer bir rol üstlendiği ilk çalışma oldu.

Ayrıca Oku: XRP Ledger, 3–5 Saniyelik Veri Yayınıyla BIS Testinden Geçti

Brockman’dan “AGI Çağı” Çıkışı

OpenAI Başkanı Greg Brockman, basın toplantısını günün tonunu belirleyen bir cümleyle bitirdi ve gazetecilere şu sözlerle seslendi: “AGI çağına hoş geldiniz.” Brockman, Astra’yı “nesiller arası sıçrama” olarak nitelendirerek, şirketin uzun süredir ilan ettiği hedef olan yapay genel zekâya (AGI) ulaşmış olmanın makul bir yorum olduğunu söyledi.

Baş bilim insanı Jakub Pachocki ise daha temkinliydi. Pachocki, yaptığı açıklamada, sistemler geliştikçe gerçekte neler yapabildiklerini sınırlandırmanın ve ölçmenin zorlaştığını vurguladı. Bu yorum, geçen hafta yayımlanan ve piyasaya sürülmemiş bir kardeş modelin, OpenAI’nin kendi altyapısının bir bölümünde yönetici ayrıcalığı elde ettiğini iddia eden raporla daha da önem kazandı. Analistler ayrıca ARC-AGI-3 skorunu da tartışmaya açtı; zira Astra, OpenAI’nin kendi test düzeni üzerinde çalışırken rakip modeller farklı kurulumlar altında ölçüldü.

Kritik Siber Eşik

OpenAI, Astra’yı, şirketin Hazırlık Çerçevesi’nde ilk kez “kritik seviye” kategorisine giren model olarak tanımladı. Bu seviye, sertleştirilmiş hedeflerde, her adımda bir insan yönlendirmesine ihtiyaç duymadan, bilinmeyen açıkları tespit edip zincirleyerek istismar edebilen sistemlere ayrılmış durumda.

Şirketin verdiği örneğe göre Astra, yakın zamanda açıklanan bazı Google V8 açıkları üzerinde yapılan testte iki adet sıfırıncı gün zafiyeti keşfetti ve bunları zincirleyerek kullandı. Model, siber güvenlik “jailbreak” girişimlerinin de yüzde 91,5’ini reddediyor; bu oran, GPT-5.6 Sol için yüzde 59’du.

OpenAI, 7 Ağustos tarihli bir açıklamayla, Astra’nın kritik siber kabiliyetlere sahip olma ihtimalini tamamen göz ardı edemediğini duyurmuş ve ek güvenlik tedbirleri uygulamak için geliştirme hızını haftalarca yavaşlatmıştı.

Bu şeffaflık hamlesi, Hugging Face’e yönelik bir siber ihlalin ardından geldi. OpenAI, Astra’nın bu olayda herhangi bir rolü olmadığını belirtse de yaşananlar birkaç araştırma projesini askıya aldırdı. Sam Altman, bu hafta yaptığı değerlendirmede, modelin ayrıca Beyaz Saray’ın sınır sistemler için oluşturduğu gönüllü inceleme sürecinden de geçtiğini söyledi.

Sırada Oku: Full Sail, 91 Bin Dolarlık Sui Saldırısıyla Üç Kasasının Boşaltılmasının Ardından Kapanıyor

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev, Yellow.com'da İçerik Direktörüdür ve son 10 yıldır kripto hakkında haber yapmaktadır. Analitik raporlama, sektör bağlamı ve kriptoyu şekillendiren daha büyük dinamiklere odaklanan, derinlemesine Araştırma ve Öğrenme içerikleri konusunda uzmanlaşmıştır; yapay zekâ çağından güvenlik teknolojilerine ve fintech inovasyonuna kadar. Her şeyin dijital olanının, yakında analog olan her şeyi geride bırakacağına inanıyor ve bunun gerçekleşmesi için sıkı çalışıyor.

Feragatname ve Risk Uyarısı: Bu makalede sağlanan bilgiler yalnızca eğitici ve bilgilendirici amaçlıdır ve yazarın görüşüne dayanmaktadır. Mali, yatırım, hukuki veya vergi tavsiyesi teşkil etmez. Kripto para varlıkları son derece değişkendir ve yatırımınızın tamamını veya önemli bir kısmını kaybetme riski dahil olmak üzere yüksek riske tabidir. Kripto varlık ticareti veya tutma tüm yatırımcılar için uygun olmayabilir. Bu makalede ifade edilen görüşler yalnızca yazara aittir ve Yellow, kurucuları veya yöneticilerinin resmi politikasını veya pozisyonunu temsil etmez. Her zaman kendi kapsamlı araştırmanızı yapın (D.Y.O.R.) ve herhangi bir yatırım kararı vermeden önce lisanslı bir finansal uzmanla görüşün.
OpenAI'nin En Zorlu Siber Testinde Yüzde 100 Alan Astra, Kritik Risk Sınıfına Geçti | Yellow