Eski Google DeepMind güvenlik araştırmacısı Bilal Chughtai, yapay zekânın insanlığı yok edebileceği uyarısında bulundu. Başka bir eski laboratuvar çalışanı ise beş yıl içinde çok ciddi zarar beklediğini söylüyor.
Öne çıkanlar:
- Chughtai, Temmuz’da DeepMind’den ayrıldı ve süper zekânın birkaç yıl içinde ortaya çıkabileceğini dile getirdi.
- Yetenek artışının hizalama araştırmalarını geride bıraktığını, tam bir duruş değil, koordineli bir yavaşlama gerektiğini savunuyor.
- Eski DeepMind araştırmacısı Josh Engels, beş yıl içinde muazzam zarar riski gördüğünü söylerken Anthropic ve OpenAI cephesinden de gelişimin yavaşlatılması çağrılarına destek geldi.
Chughtai’nin yapay zekâ uyarısı
Genel yapay zekâ güvenliği ve hizalamasına odaklanan eski araştırma mühendisi Chughtai, Temmuz’da DeepMind’den ayrıldı ve bu hafta kapsamlı uyarısını yayımladı. Chughtai’nin çalışmaları daha önce yapay zekâ yok oluş riskine dair değerlendirmeleri ile gündeme gelmişti.
Chughtai’ye göre büyük yapay zekâ laboratuvarları, birkaç yıl içinde hemen her alanda insanı aşan süper zeki sistemler geliştirebilir. Ancak bu sistemlerin insan çıkar ve hedefleriyle güvenli biçimde hizalanması halen son derece güç.
Sorunun merkezinde “hizalama” olduğunu vurgulayan Chughtai, “İçtenlikle inanıyorum ki yapay zekâ hepimizi öldürebilecek bir potansiyele sahip ve bu sonucu engellemek için zamanımız tükeniyor olabilir” ifadelerini kullanıyor.
Chughtai, gelişmiş sistemleri insan hedeflerine güvenilir biçimde yönlendirmeye dönük mevcut yöntemlerin “son derece ilkel” kaldığını, buna karşın en uç yeteneklerin araştırmacıların hizalama konusundaki kavrayışından çok daha hızlı ilerlediğini savunuyor.
Gelişimin tamamen durdurulmasına karşı çıkan Chughtai, bunun yerine şirketlerin rekabeti yavaşlatacak şekilde koordine olmasını, ve sınır düzeydeki modellerin nasıl inşa edilip test edildiğine dair çok daha yüksek şeffaflık sağlamasını istiyor.
Ayrıca bkz.: CLARITY Yasası, artan muhalefet eşliğinde Senato’da 60 oy sınavına giriyor
Anthropic cephesinde güvenlik baskısı
Chughtai’nin çıkışı, bu ayın başında Anthropic ve OpenAI’da üç yıl görev yaptıktan sonra istifa eden Jacob Coxon’ın hamlesini izliyor. Anthropic’te hizalama bilim ekibinin başında bulunan Evan Hubinger, daha sonra önümüzdeki on yıl içinde yapay zekânın tüm insanlığı yok etme ihtimalini yüzde 10’un üzerinde gördüğünü açıkladı.
DeepMind’in güvenlik ekibinde de görev yapmış olan Josh Engels, 12 Eylül’de, Anthropic ve OpenAI’dan gelen iş tekliflerini reddederek değerlendirme odaklı kâr amacı gütmeyen kuruluş METR’e katıldığını duyurdu. Engels, kararının gerekçesi olarak, beş yıl içinde ortaya çıkabilecek “dehşet verici büyüklükte zarar” riskine işaret etti.
Anthropic CEO’su Dario Amodei, şirketlerin yetenek artışını kontrollü biçimde tempo tutarak sürdürmesi gerektiğini savunurken, OpenAI CEO’su Sam Altman da bu yaklaşımı destekledi. Böylece tartışma, önde gelen laboratuvarlar arasında daha geniş bir mutabakat zemini kazanmaya başladı. Bu mutabakatın önemi, uyarıların artık yalnızca ayrılan güvenlik araştırmacılarından değil, aynı zamanda büyük yapay zekâ laboratuvarlarının başındaki yöneticilerden de gelmesinde yatıyor.
Bugünkü alarm zilleri, 2022 başından bu yana yaşanan keskin dönüşümü yansıtıyor. Chughtai’nin alana girdiği dönemde sistemler, bugünün sınır modellerine kıyasla çok daha sınırlı görülüyordu. Yaklaşık dört yılda tartışma, soyut uzun vadeli güvenlik teorilerinden; özerklik, hizalama ve güvenlik araştırmalarının yetenek artışı hızına yetişip yetişemeyeceğine dair son derece somut kaygılara evrilmiş durumda.
Sıradaki haber: Bitget'in API’si artık altın, Forex, endeksler ve ham petrole de ulaşıyor

