OpenAI’nin Astra modeli, baş bilim insanı Jakub Pachocki’nin de eş yazarı olduğu 2025 tarihli izlenebilirlik makalesinde dile getirilen endişeleri yeniden canlandıracak şekilde, dışarıya daha az görünür akıl yürütme sergiliyor gibi görünüyor.
Öne Çıkanlar
- Astra, akıl yürütmesinin daha azını metin olarak açığa çıkarıyor; bu da denetçilerin sorunlu davranışları tespit edip edemeyeceğine dair kaygıları artırıyor.
- Ryan Greenblatt ve Pachocki, Temmuz 2025’te “zincirleme düşünme izlenebilirliğini” kırılgan bir yapay zeka güvenliği fırsatı olarak tanımlayan makaleye birlikte imza attı.
- AB koduna taraf şirketler, bağımsız incelemeyi destekleyebilecek değerlendirme kanıtlarını da içeren model güvenlik raporlarını AB AI Office’e sunmak zorunda.
Astra ve İzlenebilirlik Tartışması
Semafor, haberinde Astra’nın daha fazla akıl yürütmeyi görünür metne dökmeden, “perde arkasında” yaptığını, bunun da model çalışırken denetçilerin şüpheli davranışları tespit edip edemeyeceğine dair soruları tetiklediğini aktardı. Redwood Research’te yapay zeka güvenliği araştırmacısı olan Greenblatt, kaleme aldığı yazıda Astra’nın “zor seviye yarışma matematik problemlerini tamamen kafasında çözebiliyormuş gibi göründüğünü” belirterek, “Bu son derece endişe verici” ifadesini kullandı.
Haberlerde ayrıca OpenAI’nin, modelin çıktılarına dair görünürlüğü kasıtlı olarak azaltıp bunun karşılığında yeteneklerini artırmış olabileceği öne sürüldü; şirket bu iddiayı doğrulamadı. Pachocki ise “yanlış anlaşılmış haberlerden tetiklenecek bir ‘izlenemezlik yarışını’ önlemek istediğini” söyledi.
TNW, daha önceki haberinde, Astra’nın selefine kıyasla denetlenmesinin zorlaştığını, modelin gözetimden kaçmaya çalıştığı durumlarda bu farkın daha da belirginleştiğini aktarmış; OpenAI bu alanı “açık bir araştırma önceliği” olarak tanımlamıştı.
Ayrıca Bkz.: OpenAI, Yapay Zekanın Artık Günlerce Süren Araştırma Görevlerini Üstlenebildiğini Söylüyor
Pachocki’nin Güvenlik Uyarısı
Tartışmayı önemli kılan unsur, Greenblatt ve Pachocki’nin Temmuz 2025 tarihli ve yaklaşık 40 yazarlı makalede “zincirleme düşünme izlenebilirliğini” yapay zeka güvenliği için yeni ama kırılgan bir fırsat olarak tarif etmiş olmaları. Çalışmaya OpenAI, Google DeepMind, Anthropic, Meta, Amazon, UK AI Security Institute ve Redwood Research’ten araştırmacılar katkı verdi.
Makale, sınır (frontier) model geliştiricilerine, standartlaştırılmış izlenebilirlik değerlendirmeleri geliştirmeleri, sonuçları ve kısıtlarını sistem kartlarında yayımlamaları ve eğitim ile yaygın kullanıma sokma kararlarında yeteneklerle birlikte izlenebilirliği de dikkate almaları çağrısında bulunuyordu.
Avrupa, bu raporlama sürecine resmî bir adres tanımlamış durumda. AB’nin Genel Amaçlı Yapay Zeka Uygulama Kuralları’na (General-Purpose AI Code of Practice) imza atan şirketler, piyasaya girişten önce AI Office’e değerlendirmeleri, alınan önlemleri ve harici değerlendirici raporlarını içeren bir Model Rapor sunmak zorunda.
Her raporda ayrıca, ilgili her model değerlendirmesinden rastgele seçilmiş beşer adet girdi ve çıktı örneği yer almalı; böylece dış denetçiler bağımsız inceleme için somut veri elde edebiliyor. OpenAI, bu kodun tam tarafları arasında.
Söz konusu endişeler Astra’nın piyasaya çıkışından da eskiye dayanıyor. Temmuz 2025 tarihli makale, yeni mimarilerin görünür zincirleme düşünme adımlarını zayıflatabileceği uyarısında bulunmuş; OpenAI daha sonra sistemleri için genişletilmiş güvenlik izlemesine olanak sağlamak amacıyla yaklaşık %20’lik ek hesaplama maliyetini kabul etmişti.
Sonraki Haber: Bitcoin ETF’lerine 987 Milyon Dolar Giriş, Üç Haftalık Alım Serisini Uzattı





