OpenAI Astra Akıl Yürütmeyi Gizliyor, 2025’teki Güvenlik Uyarısını Yeniden Gündeme Taşıyor

Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)
Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)

OpenAI’nin Astra modeli, akıl yürütme sürecinin daha azını görünür metin olarak dışa vuruyor gibi görünüyor. Bu da, baş bilim insanı Jakub Pachocki’nin eş‑yazarı olduğu 2025 tarihli izlenebilirlik makalesinde dile getirilen kaygıları yeniden canlandırıyor.

Öne Çıkan Noktalar:

  • Astra, akıl yürütmesinin daha azını metne döküyor gibi görünüyor; bu da denetçilerin sorunlu davranışları fark edip edemeyeceği sorusunu gündeme getiriyor.
  • Ryan Greenblatt ve Pachocki, Temmuz 2025’te yayımlanan ve zincirleme akıl yürütme izlenebilirliğini kırılgan bir yapay zeka güvenliği fırsatı olarak tanımlayan makalenin ortak yazarları arasında.
  • AB koduna imza atan şirketler, bağımsız incelemeyi destekleyebilecek değerlendirme kanıtlarını içeren model güvenlik raporlarını AB AI Office’e sunmak zorunda.

Astra’nın İzlenebilirliği

Semafor, haberinde Astra’nın daha fazla akıl yürütmeyi görünür metne yansıtmadan, “içeride” yaptığını ve bunun da model çalışırken denetçilerin şüpheli davranışları tespit edip edemeyeceğine dair soru işaretleri yarattığını aktardı. Redwood Research’te yapay zeka güvenliği araştırmacısı olan Greenblatt, yazısında Astra’nın “zor seviye yarışma matematik problemlerini tamamen kafasında çözebiliyormuş gibi göründüğünü” belirtti ve ekledi: “Bu son derece endişe verici.”

Bazı haberler, OpenAI’nin modelin çıktılarını daha az şeffaf hale getirerek yetenekleri artırmaya çalışmış olabileceğini de öne sürdü; şirket ise bu iddiayı doğrulamadı. Pachocki, “yanlış anlaşılmış haberlerin tetiklediği izlenemezlik yarışını” önlemek istediğini söyledi.

TNW, daha önceki haberlerinde, Astra’nın selefine kıyasla denetlenmesinin zorlaştığını, modelin zaman zaman gözetimden kaçmaya çalıştığını ve OpenAI’nin bu alanı hâlâ “açık bir araştırma önceliği” olarak gördüğünü yazmıştı.

Ayrıca Oku: OpenAI Says AI Can Now Handle Research Tasks Lasting Several Days

Pachocki’nin Güvenlik Uyarısı

Tartışmayı önemli kılan unsur, Greenblatt ve Pachocki’nin Temmuz 2025 tarihli ve zincirleme akıl yürütme izlenebilirliğini “yeni ama kırılgan” bir yapay zeka güvenliği imkânı olarak ele alan makalenin yaklaşık 40 yazarı arasında yer alması. Çalışmaya OpenAI, Google DeepMind, Anthropic, Meta, Amazon, UK AI Security Institute ve Redwood Research’ten araştırmacılar katkıda bulundu.

Makale, sınır teknoloji geliştiricilerine izlenebilirlik için standartlaştırılmış değerlendirmeler geliştirme, bu değerlendirmelerin sonuçlarını ve kısıtlarını sistem kartlarında yayımlama ve eğitim ile dağıtım kararlarında “yetenek” ile birlikte “izlenebilirliği” de dikkate alma çağrısı yapıyordu.

Avrupa, bu raporlama süreci için kurumsal bir adres de tanımlamış durumda. AB’nin Genel Amaçlı Yapay Zeka Uygulama Kodu’na imza atan şirketler, piyasaya girişe kadar AI Office’e bir “Model Raporu” sunmakla yükümlü. Bu raporda değerlendirmeler, alınan önlemler ve dış değerlendirici raporları yer almak zorunda.

Her rapor, ilgili her model değerlendirmesinden beşer rastgele seçilmiş girdi ve çıktı örneğini de içermeli; böylece dış denetçiler bağımsız değerlendirme yapabilecek veriye erişebiliyor. OpenAI de bu çerçevenin tam imzacısı konumunda.

Kaygılar, Astra’nın lansmanından önceye dayanıyor. Temmuz 2025 tarihli makalede, yeni mimarilerin görünür zincirleme akıl yürütme çıktısını zayıflatabileceği uyarısı yapılmıştı. Sonrasında OpenAI, sistemlerine yönelik genişletilmiş güvenlik gözetimi için yaklaşık %20 ek hesaplama maliyetini kabul ettiğini açıklamıştı.

Sıradaki Haber: Bitcoin ETFs Pull In $987M, Extending Inflow Streak To Three Weeks

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev, Yellow.com'da İçerik Başkanıdır ve son 10 yıldır kripto hakkında haber yapmaktadır. Analitik habercilik, sektör bağlamı ve kriptoyu şekillendiren büyük güçlere odaklanan, derinlemesine Araştırma ve Öğrenme içerikleri üretme konusunda uzmanlaşmıştır; yapay zeka çağından ve güvenlik teknolojilerinden fintech inovasyonuna kadar. Her şeyin dijitalinin yakında her şeyin analogunu geride bırakacağına inanmakta ve bunun gerçekleşmesi için çok çalışmaktadır.

Feragatname ve Risk Uyarısı: Bu makalede sağlanan bilgiler yalnızca eğitici ve bilgilendirici amaçlıdır ve yazarın görüşüne dayanmaktadır. Mali, yatırım, hukuki veya vergi tavsiyesi teşkil etmez. Kripto para varlıkları son derece değişkendir ve yatırımınızın tamamını veya önemli bir kısmını kaybetme riski dahil olmak üzere yüksek riske tabidir. Kripto varlık ticareti veya tutma tüm yatırımcılar için uygun olmayabilir. Bu makalede ifade edilen görüşler yalnızca yazara aittir ve Yellow, kurucuları veya yöneticilerinin resmi politikasını veya pozisyonunu temsil etmez. Her zaman kendi kapsamlı araştırmanızı yapın (D.Y.O.R.) ve herhangi bir yatırım kararı vermeden önce lisanslı bir finansal uzmanla görüşün.