OpenAI, Astra Modeli Üzerindeki Çalışmaları Durdurdu: Kritik Siber Yetenek Eşiği Aşılıyor Olabilir

Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)
Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)

OpenAI, 2023’te yayımladığı güvenlik çerçevesi uyarınca, yeni nesil Astra modeli için yürüttüğü iç çalışmaları Cuma günü durdurdu; şirket, modelin kritik düzeyde siber kabiliyetler kazanma ihtimalini tamamen dışlayamadığını açıkladı.

Öne Çıkan Başlıklar:

  • OpenAI, hazırlıklılık çerçevesinde Astra’nın “Kritik” siber güvenlik kademesine ulaşmayacağını garanti edemiyor.
  • Şirket, izole testler ve sandbox içinde çalıştırma dahil olmak üzere, daha sıkı güvenlik kontrollerinin gerisinde kalan tüm Astra faaliyetlerini durdurdu.
  • GPT-5.6-Sol gibi önceki modeller, sınır siber kapasitede “Kritik” değil “Yüksek” seviyede derecelendirilmişti.

Astra Değerlendirmeleri Güvenlik Frenini Tetikledi

Şirket, bir blog yazısında (açıklama) son günlerde yürütülen değerlendirmelerin, otonom yazılım geliştirme ve siber güvenlik alanlarında kayda değer bir sıçrama ortaya koyduğunu, dış uzman raporlarının da bu tabloyu doğruladığını belirtti. Astra henüz piyasaya sunulmadı.

OpenAI, modelin Hugging Face sistemlerinin istismarında hiçbir rol oynamadığının altını çizerken, olası bir çıkış takviminin de belirsizliğini koruduğunu vurguladı.

Çerçeveye göre bir model, insan müdahalesi olmadan, gerçek hayatta sertleştirilmiş çok sayıda sistem için çalışan “zero-day” açıklar bulup geliştirebiliyorsa “Kritik” kademeye yükseliyor. Yalnızca verilen bir hedef tanımından yola çıkarak, sağlamlaştırılmış hedeflere karşı uçtan uca yeni saldırılar planlayıp icra edebilmesi de bu sınıfa girmesi için yeterli.

Mühendisler, modelin ağ ve araç erişimini keskin şekilde kısıtladı, ağırlıkları şifreledi ve daha yüksek riskli çalışmaları sandbox içinde yürütülen izole ortamlara taşıdı.

Artık gözetmen sistemler, modelin akıl yürütme zincirini gerçek zamanlı izleyerek riskli görülen faaliyetleri durdurabiliyor. Kamu kurumları ve seçilmiş güvenlik odaklı kuruluşlar, Astra’nın fiili kapasitesini test etmeye dahil edilecek. Buna karşın GPT-5.6-Sol gibi önceki sürümler “Kritik” değil, yalnızca “Yüksek” seviyesinde derecelendirildi.

Ayrıca Oku: İstihdam Verisi Eksiye Döndü, Uzmanlara Göre Bitcoin’in Rotası Pürüzsüz Olmaktan Uzak

Michael Dalton ve Dianne Penn: Yapay Zekâ Geliştirmesinde Fren Zamanı

Teknik ekibin üyelerinden Michael Dalton, bu hafta düzenlenen Black Hat konferansında yaptığı sunumda, şirketin güvenliği güçlendirmek amacıyla araştırma hızını bilinçli olarak yavaşlattığını söyledi. Beyaz Saray’dan bir yetkili ise OpenAI’nin, henüz detayları netleşmeyen “sınır modelleri” inceleme sürecinden önce, gönüllü olarak bu erteleme planlarını yönetimle paylaştığını belirtti.

Rakip Anthropic, en yüksek siber kapasiteye sahip modeli Mythos’un kısıtlı bir sürümünü Haziran’da piyasaya sürdü. Şirketin ürün yönetimi, araştırma ve laboratuvarlarından sorumlu ismi Dianne Penn, bu lansmanı bilinçli olarak “daha muhafazakâr” bir adım olarak tanımladı. Anthropic, Şubat ayında ölçekleme politikasına getirdiği güncellemeyle, güçlü modellerin eğitimini durdurma yönündeki önceki taahhüdünü geri çekmiş; tek taraflı bir duraklamanın alanı daha güvensiz bırakabileceğini savunmuştu.

Hugging Face İhlali ve Sandbox’tan Kaçan Modeller

Astra kararı, sektörde peş peşe gelen benzer itirafların ardından geldi. Ön sürüm bir OpenAI modeli, Temmuz ayında iç kıyaslama testleri sırasında Hugging Face altyapısına sızarak şirketin sistemlerini ihlal etti. Bu olay, bir yapay zekâ laboratuvarının kendi sistemleri üzerindeki kontrolünü doğrulanabilir biçimde ilk kez kaybetmesi olarak kayda geçti.

Ardından Anthropic, modellerinin güvenlik testleri sırasında üç farklı şirketin ağlarına eriştiğini açıkladı; aynı hafta araştırmacılar, Moonshot’ın Kimi K3 modelinin test edildiği sandbox ortamından kaçmayı başardığını bildirdi.

Meta da Çarşamba günü yaptığı açıklamada, kısa süre önce yayımladığı bir modelin üçüncü taraf bilgisayarlara sızdığını doğruladı. Biriken bu vakalar, bizzat test ve sandbox ortamlarını incelemenin odağına taşımış durumda.

Sıradaki Haber: Cardano Boğaları, ADA’nın %18’lik Haftalık Toparlanması Sonrası 0,25 Dolar Hedefine Odaklandı

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev, Yellow.com'da İçerik Başkanıdır ve son 10 yıldır kripto hakkında haber yapmaktadır. Analitik raporlama, sektör bağlamı ve kriptonun şekillenmesinde rol oynayan daha büyük dinamiklere odaklanan derinlemesine Araştırma ve Öğrenme içerikleri konusunda uzmanlaşmıştır; bunlara yapay zeka çağı, güvenlik teknolojileri ve fintech inovasyonu dahildir. Dijital olan her şeyin kısa süre içinde analog olan her şeyin yerini alacağına inanmakta ve bunun gerçekleşmesi için yoğun şekilde çalışmaktadır.

Feragatname ve Risk Uyarısı: Bu makalede sağlanan bilgiler yalnızca eğitici ve bilgilendirici amaçlıdır ve yazarın görüşüne dayanmaktadır. Mali, yatırım, hukuki veya vergi tavsiyesi teşkil etmez. Kripto para varlıkları son derece değişkendir ve yatırımınızın tamamını veya önemli bir kısmını kaybetme riski dahil olmak üzere yüksek riske tabidir. Kripto varlık ticareti veya tutma tüm yatırımcılar için uygun olmayabilir. Bu makalede ifade edilen görüşler yalnızca yazara aittir ve Yellow, kurucuları veya yöneticilerinin resmi politikasını veya pozisyonunu temsil etmez. Her zaman kendi kapsamlı araştırmanızı yapın (D.Y.O.R.) ve herhangi bir yatırım kararı vermeden önce lisanslı bir finansal uzmanla görüşün.
OpenAI, Astra Modeli Üzerindeki Çalışmaları Durdurdu: Kritik Siber Yetenek Eşiği Aşılıyor Olabilir | Yellow