Anthropic araştırmacısı Jacob Coxon, kontrolden çıkabilecek yapay zekâ endişesiyle bu hafta görevinden ayrıldı. Şirketin hizalama (alignment) birimini yöneten isim ise bu on yıl içinde insanlığın yapay zekâ yüzünden yok olma riskini %10’un üzerinde gördüğünü açıkladı.
Öne Çıkan Başlıklar:
- Jacob Coxon, Anthropic ve OpenAI’de geçirdiği üç yıllık ön eğitim (pretraining) araştırmalarının ardından, iki şirketin de kontrol edemeyecekleri sistemlere doğru yarıştığını söyleyerek ayrıldı.
- Anthropic’in hizalama bilimi lideri Evan Hubinger, yapay zekânın tüm insanları öldürme ihtimalini önümüzdeki on yıl içinde kişisel kanaatine göre %10’un üzerinde hesaplıyor.
- Hubinger, hâlihazırdaki modelleri düşük riskli bulurken, asıl tehlikeyi kendi kendini yineleyerek geliştiren (recursive self-improvement) sistemlerde görüyor.
Jacob Coxon: “Yapay Zekâ Yarışı İçin Anthropic’ten Ayrıldım”
27 yaşındaki Coxon, OpenAI ve Anthropic’te üç yıl boyunca model ön eğitimi üzerine çalıştıktan sonra, Çarşamba sabahı X’te paylaştığı bir zincirle istifasını duyurdu. Paylaşımında, ne Anthropic’in ne de OpenAI’nin yeterince sorumlu davrandığını, her iki kurumun da insan hayatını riske atarak kendi kendini geliştiren bir süper zekâya doğru “yarış halinde” ilerlediğini savundu. Zincirin ilk iletisi birkaç saat içinde 19 milyondan fazla görüntülenme aldı.
Ayrı bir röportajda, en saldırgan senaryoların artık “baz senaryo” haline geldiğini ve işlerin gelecek yılın sonuna kadar kontrolden çıkabileceği uyarısında bulundu. Coxon, meslektaşlarının laboratuvarların gidişatını tanımlarken artık “son düzlüğe girdik” (crunchtime) ve “endgame” gibi ifadeler kullandığını anlattı.
Matematik eğitimi alan Coxon, model eğitimi alanına geçmeden önce OpenAI’de çalışmaya başlamış, bu yılın başında ise daha “güvenlik odaklı” imajı nedeniyle Anthropic’e transfer olmuştu. Ancak ona göre, rakip laboratuvarların doğrudan rekabete girmesiyle güvenlikten taviz verme baskısı kaçınılmaz hale geliyor. Bugün geldiği noktada, devlet müdahalesi veya sektör genelinde koordineli bir yavaşlama olmadan hiçbir şirketin insan seviyesinde yapay zekâyı sorumlu biçimde geliştiremeyeceğini savunuyor.
Ayrıca Oku: XRP Fiyatı, Eylül’de Balina Birikimiyle 1,46 Doları Hedefliyor
Evan Hubinger: Yok Oluş Olasılığı %10’un Üzerinde
Anthropic’te hizalama biliminden sorumlu olan ve şirket modelleri üzerinde stres testleri yürüten Evan Hubinger, Coxon’un tabloyu “doğru resmettiğini” belirterek tartışmaya katıldı. Hubinger, yapay zekânın tüm insanlığı ortadan kaldırma ihtimalini önümüzdeki on yıl içinde kişisel hesabına göre %10’un üzerinde görüyor.
Hubinger, şirketin elinden gelenin en iyisini yapmaya çalıştığını, ancak süper zekâ seviyesindeki sistemler için hizalama sorununa hazır bir çözüm planlarının olmadığını ve bu yolda net bir ilerleme patikası göremediğini açıkça söyledi. Sonrasında yaptığı bir açıklamada, bugün piyasada bulunan modellerin riskini “düşük” olarak nitelendirdi. Asıl kaygısının, sistemlerin kendi haleflerini eğitmeye başlamasıyla devreye girebilecek, kendi kendini yineleyerek geliştiren bir süper zekâ (recursive self-improvement) senaryosunda yoğunlaştığını vurguladı.
Bu oran, Anthropic’in resmi tahmini değil; tamamen Hubinger’ın kişisel değerlendirmesi. Ayrıca bu tür sayısal risk tahminleri, gelecekteki yapay zekâ kabiliyetleri ve bunların nasıl devreye alınacağına dair son derece tartışmalı varsayımlara dayanıyor. Anthropic, daha önce yaptığı kamuoyu açıklamalarında, kendi kendini yineleyerek geliştiren süper zekânın “kaçınılmaz” olmadığını, ancak kurumların hazırlık seviyesinden daha erken ortaya çıkabileceğini ve bu durumda insanların kontrolü kaybetme olasılığını artırabileceğini belirtmişti.
Anthropic’te Güvenlik Cephesinden Peş Peşe Ayrılıklar
Coxon, Anthropic’ten ayrılan ilk güvenlik araştırmacısı değil. Şirketin güvenlik önlemleri (safeguards) ekibine liderlik eden Mrinank Sharma da bu yılın başlarında dünyayı ciddi bir tehlikeyle karşı karşıya bırakan bir patikada ilerlendiği uyarısıyla görevinden ayrıldı ve Britanya’da şiir çalışacağını açıkladı.
2021’de eski OpenAI çalışanları tarafından kurulan Anthropic, özellikle yapay zekâ güvenliği ve hizalama araştırmalarına odaklanmasıyla tanınıyor. Şirket, Çarşamba sabahına kadar Coxon’un ayrılığına ilişkin kamuya açık bir açıklama yapmamıştı.
Sıradaki Haber: Bitget, 642.000+ Öğrenciye Ulaşan UNICEF Programına Blokzincir Dersleri Ekliyor





