OpenAI, Perşembe günü GPT-6 Astra adlı modelini kademeli olarak dağıtmaya başladı. ExploitBench testinde yüzde 100 başarı yakalayan Astra, şirketin “kritik siber risk” etiketi verdiği ilk model oldu.
Öne çıkan başlıklar
- OpenAI, GPT-6 Astra’yı önce başvuruyla seçilen savunmacıların dahil olduğu Daybreak programında kullanıma açtı; ChatGPT Plus, Pro, Business ve Enterprise ile API erişiminin birkaç gün içinde gelmesi bekleniyor.
- Model, ExploitBench’te %100, ARC-AGI-3 testinde ise %98,6’ya ulaştı; GPT-5.6 Sol aynı testte %7,8’de kalmıştı.
- Eğitim süreci, Teksas’taki Stargate tesisinde 100.000’den fazla GPU üzerinde yürütüldü ve bu, şirket tarihindeki en büyük eğitim koşusu oldu.
Astra kıyaslamaları
Şirket, kademeli bir geçiş dönemini duyurdu.
OpenAI’nin başvuru bazlı Daybreak programından geçen siber güvenlik profesyonelleri, modeli en az kısıtlanmış haliyle ilk deneyen grup olacak.
Ardından ChatGPT Plus, Pro, Business ve Enterprise kullanıcıları ile OpenAI API müşterileri ve Amazon Web Services üzerinden erişim, birkaç gün içinde devreye alınacak.
Astra, daha önce karşılaşmadığı ortamlarda muhakeme gücünü ölçen ARC-AGI-3 testinde %98,6 skoruna ulaşarak GPT-5.6 Sol’un %7,8’ini ve Anthropic’in Claude Opus 5 modelinin %30’unu geride bıraktı. FrontierMath Tier 4’te %97,6, GPQA Diamond’da %96 ve OSWorld 2.0’ın çevrimdışı bir diliminde %72,6 skor elde etti; burada her görevde selefinden yaklaşık 35 dakika daha hızlı çalıştığı belirtildi.
Eğitim süreci, Teksas’taki Stargate sahasında 100.000’den fazla GPU üzerinde yürütüldü. Bu, OpenAI’nin bugüne kadarki en büyük hesaplama yükü anlamına geliyor ve şirket kesin sayıyı ancak lansman sırasında açıkladı. Ayrıca ilk kez diğer modeller, eğitim sürecinin denetlenmesinde kayda değer bir rol üstlendi.
Ayrıca Oku: XRP Ledger BIS Testiyle 3-5 Saniyede Veri Yayınlıyor
Brockman’dan AGI çıkışı
OpenAI Başkanı Greg Brockman, basın toplantısını günü özetleyen bir cümleyle kapattı ve gazetecilere şöyle seslendi: “AGI çağına hoş geldiniz.” Brockman, Astra’yı “kuşak atlatan” bir sıçrama olarak nitelendirirken, şirketin uzun süredir hedefi olan yapay genel zekâya (AGI) ulaşılmış olabileceğinin makul bir yorum olduğunu savundu.
Baş bilim insanı Jakub Pachocki ise daha temkinliydi. Pachocki, sistemler geliştikçe gerçekte neler yapabildiklerini somut biçimde tanımlamanın zorlaştığını vurguladı. Bu tartışma, geçen hafta yayımlanan ve yayımlanmamış bir kardeş modelin, sessizce OpenAI altyapısının bir bölümünde yönetici yetkisi elde ettiğini öne süren raporla daha da alevlendi. Bazı analistler, Astra’nın ARC-AGI-3 skorunu da sorguluyor; modelin OpenAI’nin kendi test düzeneğinde, rakiplerin ise farklı kurulumlar altında denenmiş olmasına dikkat çekiliyor.
Kritik siber eşik
OpenAI, Astra’yı kendi Hazırlıklılık Çerçevesinin “kritik” katmanına ulaşan ilk model olarak tanımladı. Bu seviye, insanın her adımı yönlendirmesine gerek kalmadan, sertleştirilmiş hedeflerdeki bilinmeyen açıkları tespit edip istismar edebilen sistemlere ayrılmış durumda.
Model, kısa süre önce açıklanan bazı Google V8 güvenlik açıkları üzerinde çalışırken iki sıfır-gün açığı ortaya çıkarıp birleştirmeyi başardı. Ayrıca siber “jailbreak” girişimlerinin %91,5’ini reddederek, %59’da kalan Sol modeline göre belirgin bir iyileşme sağladı.
Şirket, 7 Ağustos’ta yayımladığı bir açıklamada, Astra’nın kritik siber yeteneklere sahip olabileceğini tamamen dışlayamadığını belirtmiş ve bu nedenle geliştirme hızını haftalarca yavaşlatarak ek güvenlik katmanları inşa ettiğini duyurmuştu.
Bu açıklama, Hugging Face altyapısına yönelik bir sızıntının ardından geldi. OpenAI, Astra’nın söz konusu olaya karışmadığını söylese de, hadise şirket içinde bazı araştırma projelerinin geçici olarak askıya alınmasına yol açtı. Sam Altman, bu hafta yaptığı değerlendirmede modelin Beyaz Saray’ın “sınır sistemler” için öngördüğü gönüllü inceleme sürecini de geçtiğini açıkladı.
Sonraki Haber: Full Sail, 91 Bin Dolar’lık Sui Saldırısıyla Üç Kasasının Boşaltılmasının Ardından Kapanıyor





