OpenAI, perşembe günü GPT-6 Astra için kademeli dağıtıma başladı. ExploitBench’te yüzde 100’lük “mükemmel” skor alan Astra, şirketin kendi çerçevesinde ilk kez “kritik siber risk” etiketi verdiği model oldu.
Öne Çıkanlar
- OpenAI, GPT-6 Astra’yı perşembe günü önce başvuruyla seçilen savunmacıların yer aldığı Daybreak programında devreye aldı; ChatGPT Plus, Pro, Business ve Enterprise kullanıcıları ile API erişimi ise birkaç gün içinde açılacak.
- Model, ExploitBench’te yüzde 100, ARC-AGI-3’te ise yüzde 98,6 skor elde etti; aynı testte GPT-5.6 Sol’un skoru yüzde 7,8’de kalmıştı.
- Eğitim, Texas’taki Stargate sahasında 100.000’den fazla GPU üzerinde yürütüldü ve şirkete göre bugüne kadarki en büyük eğitim koşusu oldu.
Astra’nın Benchmark Sonuçları
Şirket, Astra için kademeli bir çıkış planı benimsedi.
OpenAI’nin başvuru esaslı Daybreak programı üzerinden doğrulanmış siber güvenlik savunmacıları, modele ilk erişen grup ve en az kısıtlamayla çalışan sürümü kullanıyor.
Bunu, birkaç gün içinde ChatGPT Plus, Pro, Business ve Enterprise aboneleri, OpenAI API müşterileri ve Amazon Web Services entegrasyonu takip edecek.
Astra, daha önce görmediği senaryolarda akıl yürütme kabiliyetini ölçen ARC-AGI-3 testinde yüzde 98,6’lık skor elde etti. Aynı testte GPT-5.6 Sol yüzde 7,8’de, Anthropic imzalı Claude Opus 5 ise yüzde 30 seviyesinde kalmıştı. Model ayrıca FrontierMath Tier 4’te yüzde 97,6, GPQA Diamond’da yüzde 96 ve OSWorld 2.0’ın çevrimdışı bir bölümünde yüzde 72,6 skor elde etti; burada önceki nesle kıyasla görev başına yaklaşık 35 dakika daha hızlı çalıştı.
Eğitim süreci, Texas’taki Stargate tesisinde 100.000’in üzerinde GPU kullanılarak yürütüldü. Bu, OpenAI’nin bugüne dek denediği en büyük eğitim koşusu olarak açıklandı ve kullanılan hesaplama gücü ilk kez lansmanla birlikte resmen duyuruldu. Aynı zamanda, diğer yapay zeka modellerinin de eğitimi denetlemede kayda değer bir rol üstlendiği ilk çalışma oldu.
Ayrıca Oku: XRP Ledger, 3–5 Saniyelik Veri Yayınıyla BIS Testinden Geçti
Brockman’dan “AGI Çağı” Çıkışı
OpenAI Başkanı Greg Brockman, basın toplantısını günün tonunu belirleyen bir cümleyle bitirdi ve gazetecilere şu sözlerle seslendi: “AGI çağına hoş geldiniz.” Brockman, Astra’yı “nesiller arası sıçrama” olarak nitelendirerek, şirketin uzun süredir ilan ettiği hedef olan yapay genel zekâya (AGI) ulaşmış olmanın makul bir yorum olduğunu söyledi.
Baş bilim insanı Jakub Pachocki ise daha temkinliydi. Pachocki, yaptığı açıklamada, sistemler geliştikçe gerçekte neler yapabildiklerini sınırlandırmanın ve ölçmenin zorlaştığını vurguladı. Bu yorum, geçen hafta yayımlanan ve piyasaya sürülmemiş bir kardeş modelin, OpenAI’nin kendi altyapısının bir bölümünde yönetici ayrıcalığı elde ettiğini iddia eden raporla daha da önem kazandı. Analistler ayrıca ARC-AGI-3 skorunu da tartışmaya açtı; zira Astra, OpenAI’nin kendi test düzeni üzerinde çalışırken rakip modeller farklı kurulumlar altında ölçüldü.
Kritik Siber Eşik
OpenAI, Astra’yı, şirketin Hazırlık Çerçevesi’nde ilk kez “kritik seviye” kategorisine giren model olarak tanımladı. Bu seviye, sertleştirilmiş hedeflerde, her adımda bir insan yönlendirmesine ihtiyaç duymadan, bilinmeyen açıkları tespit edip zincirleyerek istismar edebilen sistemlere ayrılmış durumda.
Şirketin verdiği örneğe göre Astra, yakın zamanda açıklanan bazı Google V8 açıkları üzerinde yapılan testte iki adet sıfırıncı gün zafiyeti keşfetti ve bunları zincirleyerek kullandı. Model, siber güvenlik “jailbreak” girişimlerinin de yüzde 91,5’ini reddediyor; bu oran, GPT-5.6 Sol için yüzde 59’du.
OpenAI, 7 Ağustos tarihli bir açıklamayla, Astra’nın kritik siber kabiliyetlere sahip olma ihtimalini tamamen göz ardı edemediğini duyurmuş ve ek güvenlik tedbirleri uygulamak için geliştirme hızını haftalarca yavaşlatmıştı.
Bu şeffaflık hamlesi, Hugging Face’e yönelik bir siber ihlalin ardından geldi. OpenAI, Astra’nın bu olayda herhangi bir rolü olmadığını belirtse de yaşananlar birkaç araştırma projesini askıya aldırdı. Sam Altman, bu hafta yaptığı değerlendirmede, modelin ayrıca Beyaz Saray’ın sınır sistemler için oluşturduğu gönüllü inceleme sürecinden de geçtiğini söyledi.
Sırada Oku: Full Sail, 91 Bin Dolarlık Sui Saldırısıyla Üç Kasasının Boşaltılmasının Ardından Kapanıyor

