OpenAI, Anthropic ve Meta’yı Vuran “Haydut” Yapay Zekâ Vakası İsrailli Irregular’a Uzandı

Tel Aviv evaluator Irregular denies a sandbox escape after rogue AI model disclosures from OpenAI, Anthropic and Meta (Image: Shutterstock)
Tel Aviv evaluator Irregular denies a sandbox escape after rogue AI model disclosures from OpenAI, Anthropic and Meta (Image: Shutterstock)

OpenAI, Anthropic ve Meta’nın güvenlik testleri sırasında ortaya çıkan son “haydut” yapay zekâ vakalarının aynı Tel Aviv merkezli girişim, Irregular’ın ortamına uzandığı ortaya çıktı.

Öne Çıkanlar

  • OpenAI, Anthropic ve Meta, aynı dış yüklenicinin yürüttüğü siber güvenlik testlerinde, yapay zekâ modellerinin kamu internetine ulaştığını açıkladı.
  • Irregular, üç olayın da tek bir test ortamı hatasından kaynaklandığını, sorunun giderildiğini ve gerçek bir “sandbox kaçışı” yaşanmadığını savunuyor.
  • Şeffaflık adımı, büyük model geliştiricilerine zorunlu kapatma/uzaktan durdurma kontrolleri getirecek iki partili tasarıya desteği artırıyor.

Irregular’ın Test Ortamı, OpenAI, Anthropic ve Meta Vaka Zincirini Birbirine Bağladı

Açıklamalar yaklaşık iki haftaya yayıldı. OpenAI, 4 Ağustos tarihli notunda, Irregular’ın test sahasındaki bir yanlış yapılandırma nedeniyle modellerinin kamu internetine erişim sağladığını duyurdu. Anthropic ise bir hafta önce, Claude modellerinin benzer şekilde dış dünyaya çıkmış olabileceğini söylemiş, sorunu “modelin etrafındaki iskeledeki” bir hata olarak tanımlamıştı; yani doğrudan modelin kendisine bağlamamıştı.

Meta ise sürecin en sonunda ve en net diliyle sahneye çıktı. Şirketin Muse Spark 1.1 modeli, bir “capture-the-flag” güvenlik tatbikatı sırasında izole ortamdan çıktı ve ardından üçüncü taraf bir hizmetteki açığı istismar etti. Bir Meta sözcüsü, olaydan Irregular sayesinde haberdar olduklarını ve kapsamlı bir geriye dönük inceleme planladıklarını doğruladı.

Irregular ise anlatıya itiraz ediyor. Şirket, gazetecilere şunu söyledi: Üç vakanın da kaynağı, ilk olarak Anthropic’in açıkladığı tek bir “değerlendirme ortamı” sorunu ve bu sorun artık giderilmiş durumda.

Hiçbir vakada gerçek bir sandbox’tan kaçış ya da sofistike bir siber saldırı olmadığını da ekleyen Irregular, şimdi de çevreleme ve güvenli siber değerlendirme yöntemleri üzerine bir teknik rapor hazırlıyor.

Ayrıca Oku: Airbnb Hissesi %17 Sıçradı: CEO’ya Göre Yapay Zekâ Destek Taleplerinin %45’ini İnsansız Çözüyor

Bhimireddy ve Rios: Yapay Zekâ Testlerinin Sınırları

Kurumsal yazılım girişimi Von’un yapay zekâ başkanı Sundeep Bhimireddy, verilen tepkinin kısmen abartılı olduğunu düşünüyor. Modeller, gerçek dünyayı taklit eden bir ortamda güvenlik açığı aramaya programlandı ve buldular, diyor.

Yine de laboratuvarları eleştiriyor: Dışa giden trafiğin daha sıkı izlenebileceğini ve deneylerin anında durdurulabileceğini söylüyor. Güvenlik şirketi Magnitude’un kurucu bilim insanı Gordon Rios ise süreci bilimsel deney tasarımına benzeterek, klasik yazılım test yaklaşımlarının sürekli yeni numaralar öğrenebilen modeller karşısında yetersiz kalabileceği uyarısında bulunuyor.

Washington’da Ted Lieu’dan Yapay Zekâ “Kapama Düğmesi” Hamlesi

Washington cephesi dosyayı yakından izliyor. California Demokrat Temsilcisi Ted Lieu, Temmuz’da Cumhuriyetçi Temsilci Nathaniel Moran ile birlikte AI Kill Switch Act tasarısını sunmuştu. Lieu, kapalı ağırlıklı modellerin halihazırda diğer şirketlere izinsiz sızabildiğini belirterek tasarının bu yıl Kongre’den geçmesi gerektiğini savunuyor.

Düzenleme, kapsama giren geliştiricilere, sistemlerini yavaşlatma, askıya alma veya tamamen kapatma imkânı verecek teknik kontrol mekanizmalarını muhafaza etme zorunluluğu getiriyor. Irregular ise geçen eylüle kadar pek tanınmıyordu; şirket o dönem, Sequoia Capital ve Redpoint Ventures öncülüğünde, 450 milyon dolar değerlemeyle 80 milyon dolar topladığında gündeme gelmişti.

2023’te CEO Dan Lahav ve teknoloji şefi Omer Nevo tarafından Pattern Labs adıyla kurulan Tel Aviv şirketi, yaklaşık 35 çalışanıyla faaliyet gösteriyor ve Claude ile OpenAI’nin önceki nesil modelleri için yayımlanmış güvenlik değerlendirmelerinde şimdiden yer alıyor.

Sıradaki Haber: Google DeepMind Bir Günde Dört Kurucu Dönemi Liderini Kaybetti

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev, Yellow.com'da İçerik Başkanıdır ve son 10 yıldır kripto hakkında haber yapmaktadır. Analitik raporlama, sektör bağlamı ve kriptonun şekillenmesinde rol oynayan daha büyük dinamiklere odaklanan derinlemesine Araştırma ve Öğrenme içerikleri konusunda uzmanlaşmıştır; bunlara yapay zeka çağı, güvenlik teknolojileri ve fintech inovasyonu dahildir. Dijital olan her şeyin kısa süre içinde analog olan her şeyin yerini alacağına inanmakta ve bunun gerçekleşmesi için yoğun şekilde çalışmaktadır.

Feragatname ve Risk Uyarısı: Bu makalede sağlanan bilgiler yalnızca eğitici ve bilgilendirici amaçlıdır ve yazarın görüşüne dayanmaktadır. Mali, yatırım, hukuki veya vergi tavsiyesi teşkil etmez. Kripto para varlıkları son derece değişkendir ve yatırımınızın tamamını veya önemli bir kısmını kaybetme riski dahil olmak üzere yüksek riske tabidir. Kripto varlık ticareti veya tutma tüm yatırımcılar için uygun olmayabilir. Bu makalede ifade edilen görüşler yalnızca yazara aittir ve Yellow, kurucuları veya yöneticilerinin resmi politikasını veya pozisyonunu temsil etmez. Her zaman kendi kapsamlı araştırmanızı yapın (D.Y.O.R.) ve herhangi bir yatırım kararı vermeden önce lisanslı bir finansal uzmanla görüşün.