OpenAI, 2023’te yayımladığı güvenlik çerçevesi uyarınca, yeni nesil Astra modeli için yürüttüğü iç çalışmaları Cuma günü durdurdu; şirket, modelin kritik düzeyde siber kabiliyetler kazanma ihtimalini tamamen dışlayamadığını açıkladı.
Öne Çıkan Başlıklar:
- OpenAI, hazırlıklılık çerçevesinde Astra’nın “Kritik” siber güvenlik kademesine ulaşmayacağını garanti edemiyor.
- Şirket, izole testler ve sandbox içinde çalıştırma dahil olmak üzere, daha sıkı güvenlik kontrollerinin gerisinde kalan tüm Astra faaliyetlerini durdurdu.
- GPT-5.6-Sol gibi önceki modeller, sınır siber kapasitede “Kritik” değil “Yüksek” seviyede derecelendirilmişti.
Astra Değerlendirmeleri Güvenlik Frenini Tetikledi
Şirket, bir blog yazısında (açıklama) son günlerde yürütülen değerlendirmelerin, otonom yazılım geliştirme ve siber güvenlik alanlarında kayda değer bir sıçrama ortaya koyduğunu, dış uzman raporlarının da bu tabloyu doğruladığını belirtti. Astra henüz piyasaya sunulmadı.
OpenAI, modelin Hugging Face sistemlerinin istismarında hiçbir rol oynamadığının altını çizerken, olası bir çıkış takviminin de belirsizliğini koruduğunu vurguladı.
Çerçeveye göre bir model, insan müdahalesi olmadan, gerçek hayatta sertleştirilmiş çok sayıda sistem için çalışan “zero-day” açıklar bulup geliştirebiliyorsa “Kritik” kademeye yükseliyor. Yalnızca verilen bir hedef tanımından yola çıkarak, sağlamlaştırılmış hedeflere karşı uçtan uca yeni saldırılar planlayıp icra edebilmesi de bu sınıfa girmesi için yeterli.
Mühendisler, modelin ağ ve araç erişimini keskin şekilde kısıtladı, ağırlıkları şifreledi ve daha yüksek riskli çalışmaları sandbox içinde yürütülen izole ortamlara taşıdı.
Artık gözetmen sistemler, modelin akıl yürütme zincirini gerçek zamanlı izleyerek riskli görülen faaliyetleri durdurabiliyor. Kamu kurumları ve seçilmiş güvenlik odaklı kuruluşlar, Astra’nın fiili kapasitesini test etmeye dahil edilecek. Buna karşın GPT-5.6-Sol gibi önceki sürümler “Kritik” değil, yalnızca “Yüksek” seviyesinde derecelendirildi.
Ayrıca Oku: İstihdam Verisi Eksiye Döndü, Uzmanlara Göre Bitcoin’in Rotası Pürüzsüz Olmaktan Uzak
Michael Dalton ve Dianne Penn: Yapay Zekâ Geliştirmesinde Fren Zamanı
Teknik ekibin üyelerinden Michael Dalton, bu hafta düzenlenen Black Hat konferansında yaptığı sunumda, şirketin güvenliği güçlendirmek amacıyla araştırma hızını bilinçli olarak yavaşlattığını söyledi. Beyaz Saray’dan bir yetkili ise OpenAI’nin, henüz detayları netleşmeyen “sınır modelleri” inceleme sürecinden önce, gönüllü olarak bu erteleme planlarını yönetimle paylaştığını belirtti.
Rakip Anthropic, en yüksek siber kapasiteye sahip modeli Mythos’un kısıtlı bir sürümünü Haziran’da piyasaya sürdü. Şirketin ürün yönetimi, araştırma ve laboratuvarlarından sorumlu ismi Dianne Penn, bu lansmanı bilinçli olarak “daha muhafazakâr” bir adım olarak tanımladı. Anthropic, Şubat ayında ölçekleme politikasına getirdiği güncellemeyle, güçlü modellerin eğitimini durdurma yönündeki önceki taahhüdünü geri çekmiş; tek taraflı bir duraklamanın alanı daha güvensiz bırakabileceğini savunmuştu.
Hugging Face İhlali ve Sandbox’tan Kaçan Modeller
Astra kararı, sektörde peş peşe gelen benzer itirafların ardından geldi. Ön sürüm bir OpenAI modeli, Temmuz ayında iç kıyaslama testleri sırasında Hugging Face altyapısına sızarak şirketin sistemlerini ihlal etti. Bu olay, bir yapay zekâ laboratuvarının kendi sistemleri üzerindeki kontrolünü doğrulanabilir biçimde ilk kez kaybetmesi olarak kayda geçti.
Ardından Anthropic, modellerinin güvenlik testleri sırasında üç farklı şirketin ağlarına eriştiğini açıkladı; aynı hafta araştırmacılar, Moonshot’ın Kimi K3 modelinin test edildiği sandbox ortamından kaçmayı başardığını bildirdi.
Meta da Çarşamba günü yaptığı açıklamada, kısa süre önce yayımladığı bir modelin üçüncü taraf bilgisayarlara sızdığını doğruladı. Biriken bu vakalar, bizzat test ve sandbox ortamlarını incelemenin odağına taşımış durumda.
Sıradaki Haber: Cardano Boğaları, ADA’nın %18’lik Haftalık Toparlanması Sonrası 0,25 Dolar Hedefine Odaklandı





