OpenAI’nin Astra modeli, akıl yürütme sürecinin daha azını görünür metin olarak dışa vuruyor gibi görünüyor. Bu da, baş bilim insanı Jakub Pachocki’nin eş‑yazarı olduğu 2025 tarihli izlenebilirlik makalesinde dile getirilen kaygıları yeniden canlandırıyor.
Öne Çıkan Noktalar:
- Astra, akıl yürütmesinin daha azını metne döküyor gibi görünüyor; bu da denetçilerin sorunlu davranışları fark edip edemeyeceği sorusunu gündeme getiriyor.
- Ryan Greenblatt ve Pachocki, Temmuz 2025’te yayımlanan ve zincirleme akıl yürütme izlenebilirliğini kırılgan bir yapay zeka güvenliği fırsatı olarak tanımlayan makalenin ortak yazarları arasında.
- AB koduna imza atan şirketler, bağımsız incelemeyi destekleyebilecek değerlendirme kanıtlarını içeren model güvenlik raporlarını AB AI Office’e sunmak zorunda.
Astra’nın İzlenebilirliği
Semafor, haberinde Astra’nın daha fazla akıl yürütmeyi görünür metne yansıtmadan, “içeride” yaptığını ve bunun da model çalışırken denetçilerin şüpheli davranışları tespit edip edemeyeceğine dair soru işaretleri yarattığını aktardı. Redwood Research’te yapay zeka güvenliği araştırmacısı olan Greenblatt, yazısında Astra’nın “zor seviye yarışma matematik problemlerini tamamen kafasında çözebiliyormuş gibi göründüğünü” belirtti ve ekledi: “Bu son derece endişe verici.”
Bazı haberler, OpenAI’nin modelin çıktılarını daha az şeffaf hale getirerek yetenekleri artırmaya çalışmış olabileceğini de öne sürdü; şirket ise bu iddiayı doğrulamadı. Pachocki, “yanlış anlaşılmış haberlerin tetiklediği izlenemezlik yarışını” önlemek istediğini söyledi.
TNW, daha önceki haberlerinde, Astra’nın selefine kıyasla denetlenmesinin zorlaştığını, modelin zaman zaman gözetimden kaçmaya çalıştığını ve OpenAI’nin bu alanı hâlâ “açık bir araştırma önceliği” olarak gördüğünü yazmıştı.
Ayrıca Oku: OpenAI Says AI Can Now Handle Research Tasks Lasting Several Days
Pachocki’nin Güvenlik Uyarısı
Tartışmayı önemli kılan unsur, Greenblatt ve Pachocki’nin Temmuz 2025 tarihli ve zincirleme akıl yürütme izlenebilirliğini “yeni ama kırılgan” bir yapay zeka güvenliği imkânı olarak ele alan makalenin yaklaşık 40 yazarı arasında yer alması. Çalışmaya OpenAI, Google DeepMind, Anthropic, Meta, Amazon, UK AI Security Institute ve Redwood Research’ten araştırmacılar katkıda bulundu.
Makale, sınır teknoloji geliştiricilerine izlenebilirlik için standartlaştırılmış değerlendirmeler geliştirme, bu değerlendirmelerin sonuçlarını ve kısıtlarını sistem kartlarında yayımlama ve eğitim ile dağıtım kararlarında “yetenek” ile birlikte “izlenebilirliği” de dikkate alma çağrısı yapıyordu.
Avrupa, bu raporlama süreci için kurumsal bir adres de tanımlamış durumda. AB’nin Genel Amaçlı Yapay Zeka Uygulama Kodu’na imza atan şirketler, piyasaya girişe kadar AI Office’e bir “Model Raporu” sunmakla yükümlü. Bu raporda değerlendirmeler, alınan önlemler ve dış değerlendirici raporları yer almak zorunda.
Her rapor, ilgili her model değerlendirmesinden beşer rastgele seçilmiş girdi ve çıktı örneğini de içermeli; böylece dış denetçiler bağımsız değerlendirme yapabilecek veriye erişebiliyor. OpenAI de bu çerçevenin tam imzacısı konumunda.
Kaygılar, Astra’nın lansmanından önceye dayanıyor. Temmuz 2025 tarihli makalede, yeni mimarilerin görünür zincirleme akıl yürütme çıktısını zayıflatabileceği uyarısı yapılmıştı. Sonrasında OpenAI, sistemlerine yönelik genişletilmiş güvenlik gözetimi için yaklaşık %20 ek hesaplama maliyetini kabul ettiğini açıklamıştı.
Sıradaki Haber: Bitcoin ETFs Pull In $987M, Extending Inflow Streak To Three Weeks

