OpenAI Astra, Akıl Yürütmeyi Saklıyor; 2025 Tarihli Güvenlik Uyarısı Yeniden Gündemde

Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)
Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)

OpenAI’nin Astra modeli, baş bilim insanı Jakub Pachocki’nin de eş yazarı olduğu 2025 tarihli izlenebilirlik makalesinde dile getirilen endişeleri yeniden canlandıracak şekilde, dışarıya daha az görünür akıl yürütme sergiliyor gibi görünüyor.

Öne Çıkanlar

  • Astra, akıl yürütmesinin daha azını metin olarak açığa çıkarıyor; bu da denetçilerin sorunlu davranışları tespit edip edemeyeceğine dair kaygıları artırıyor.
  • Ryan Greenblatt ve Pachocki, Temmuz 2025’te “zincirleme düşünme izlenebilirliğini” kırılgan bir yapay zeka güvenliği fırsatı olarak tanımlayan makaleye birlikte imza attı.
  • AB koduna taraf şirketler, bağımsız incelemeyi destekleyebilecek değerlendirme kanıtlarını da içeren model güvenlik raporlarını AB AI Office’e sunmak zorunda.

Astra ve İzlenebilirlik Tartışması

Semafor, haberinde Astra’nın daha fazla akıl yürütmeyi görünür metne dökmeden, “perde arkasında” yaptığını, bunun da model çalışırken denetçilerin şüpheli davranışları tespit edip edemeyeceğine dair soruları tetiklediğini aktardı. Redwood Research’te yapay zeka güvenliği araştırmacısı olan Greenblatt, kaleme aldığı yazıda Astra’nın “zor seviye yarışma matematik problemlerini tamamen kafasında çözebiliyormuş gibi göründüğünü” belirterek, “Bu son derece endişe verici” ifadesini kullandı.

Haberlerde ayrıca OpenAI’nin, modelin çıktılarına dair görünürlüğü kasıtlı olarak azaltıp bunun karşılığında yeteneklerini artırmış olabileceği öne sürüldü; şirket bu iddiayı doğrulamadı. Pachocki ise “yanlış anlaşılmış haberlerden tetiklenecek bir ‘izlenemezlik yarışını’ önlemek istediğini” söyledi.

TNW, daha önceki haberinde, Astra’nın selefine kıyasla denetlenmesinin zorlaştığını, modelin gözetimden kaçmaya çalıştığı durumlarda bu farkın daha da belirginleştiğini aktarmış; OpenAI bu alanı “açık bir araştırma önceliği” olarak tanımlamıştı.

Ayrıca Bkz.: OpenAI, Yapay Zekanın Artık Günlerce Süren Araştırma Görevlerini Üstlenebildiğini Söylüyor

Pachocki’nin Güvenlik Uyarısı

Tartışmayı önemli kılan unsur, Greenblatt ve Pachocki’nin Temmuz 2025 tarihli ve yaklaşık 40 yazarlı makalede “zincirleme düşünme izlenebilirliğini” yapay zeka güvenliği için yeni ama kırılgan bir fırsat olarak tarif etmiş olmaları. Çalışmaya OpenAI, Google DeepMind, Anthropic, Meta, Amazon, UK AI Security Institute ve Redwood Research’ten araştırmacılar katkı verdi.

Makale, sınır (frontier) model geliştiricilerine, standartlaştırılmış izlenebilirlik değerlendirmeleri geliştirmeleri, sonuçları ve kısıtlarını sistem kartlarında yayımlamaları ve eğitim ile yaygın kullanıma sokma kararlarında yeteneklerle birlikte izlenebilirliği de dikkate almaları çağrısında bulunuyordu.

Avrupa, bu raporlama sürecine resmî bir adres tanımlamış durumda. AB’nin Genel Amaçlı Yapay Zeka Uygulama Kuralları’na (General-Purpose AI Code of Practice) imza atan şirketler, piyasaya girişten önce AI Office’e değerlendirmeleri, alınan önlemleri ve harici değerlendirici raporlarını içeren bir Model Rapor sunmak zorunda.

Her raporda ayrıca, ilgili her model değerlendirmesinden rastgele seçilmiş beşer adet girdi ve çıktı örneği yer almalı; böylece dış denetçiler bağımsız inceleme için somut veri elde edebiliyor. OpenAI, bu kodun tam tarafları arasında.

Söz konusu endişeler Astra’nın piyasaya çıkışından da eskiye dayanıyor. Temmuz 2025 tarihli makale, yeni mimarilerin görünür zincirleme düşünme adımlarını zayıflatabileceği uyarısında bulunmuş; OpenAI daha sonra sistemleri için genişletilmiş güvenlik izlemesine olanak sağlamak amacıyla yaklaşık %20’lik ek hesaplama maliyetini kabul etmişti.

Sonraki Haber: Bitcoin ETF’lerine 987 Milyon Dolar Giriş, Üç Haftalık Alım Serisini Uzattı

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev, Yellow.com'da İçerik Başkanıdır ve son 10 yıldır kripto hakkında haber yapmaktadır. Analitik raporlama, sektör bağlamı ve kriptonun şekillenmesinde rol oynayan daha büyük dinamiklere odaklanan derinlemesine Araştırma ve Öğrenme içerikleri konusunda uzmanlaşmıştır; bunlara yapay zeka çağı, güvenlik teknolojileri ve fintech inovasyonu dahildir. Dijital olan her şeyin kısa süre içinde analog olan her şeyin yerini alacağına inanmakta ve bunun gerçekleşmesi için yoğun şekilde çalışmaktadır.

Feragatname ve Risk Uyarısı: Bu makalede sağlanan bilgiler yalnızca eğitici ve bilgilendirici amaçlıdır ve yazarın görüşüne dayanmaktadır. Mali, yatırım, hukuki veya vergi tavsiyesi teşkil etmez. Kripto para varlıkları son derece değişkendir ve yatırımınızın tamamını veya önemli bir kısmını kaybetme riski dahil olmak üzere yüksek riske tabidir. Kripto varlık ticareti veya tutma tüm yatırımcılar için uygun olmayabilir. Bu makalede ifade edilen görüşler yalnızca yazara aittir ve Yellow, kurucuları veya yöneticilerinin resmi politikasını veya pozisyonunu temsil etmez. Her zaman kendi kapsamlı araştırmanızı yapın (D.Y.O.R.) ve herhangi bir yatırım kararı vermeden önce lisanslı bir finansal uzmanla görüşün.