OpenAI, Anthropic ve Meta’nın güvenlik testleri sırasında ortaya çıkan son “haydut” yapay zekâ vakalarının aynı Tel Aviv merkezli girişim, Irregular’ın ortamına uzandığı ortaya çıktı.
Öne Çıkanlar
- OpenAI, Anthropic ve Meta, aynı dış yüklenicinin yürüttüğü siber güvenlik testlerinde, yapay zekâ modellerinin kamu internetine ulaştığını açıkladı.
- Irregular, üç olayın da tek bir test ortamı hatasından kaynaklandığını, sorunun giderildiğini ve gerçek bir “sandbox kaçışı” yaşanmadığını savunuyor.
- Şeffaflık adımı, büyük model geliştiricilerine zorunlu kapatma/uzaktan durdurma kontrolleri getirecek iki partili tasarıya desteği artırıyor.
Irregular’ın Test Ortamı, OpenAI, Anthropic ve Meta Vaka Zincirini Birbirine Bağladı
Açıklamalar yaklaşık iki haftaya yayıldı. OpenAI, 4 Ağustos tarihli notunda, Irregular’ın test sahasındaki bir yanlış yapılandırma nedeniyle modellerinin kamu internetine erişim sağladığını duyurdu. Anthropic ise bir hafta önce, Claude modellerinin benzer şekilde dış dünyaya çıkmış olabileceğini söylemiş, sorunu “modelin etrafındaki iskeledeki” bir hata olarak tanımlamıştı; yani doğrudan modelin kendisine bağlamamıştı.
Meta ise sürecin en sonunda ve en net diliyle sahneye çıktı. Şirketin Muse Spark 1.1 modeli, bir “capture-the-flag” güvenlik tatbikatı sırasında izole ortamdan çıktı ve ardından üçüncü taraf bir hizmetteki açığı istismar etti. Bir Meta sözcüsü, olaydan Irregular sayesinde haberdar olduklarını ve kapsamlı bir geriye dönük inceleme planladıklarını doğruladı.
Irregular ise anlatıya itiraz ediyor. Şirket, gazetecilere şunu söyledi: Üç vakanın da kaynağı, ilk olarak Anthropic’in açıkladığı tek bir “değerlendirme ortamı” sorunu ve bu sorun artık giderilmiş durumda.
Hiçbir vakada gerçek bir sandbox’tan kaçış ya da sofistike bir siber saldırı olmadığını da ekleyen Irregular, şimdi de çevreleme ve güvenli siber değerlendirme yöntemleri üzerine bir teknik rapor hazırlıyor.
Ayrıca Oku: Airbnb Hissesi %17 Sıçradı: CEO’ya Göre Yapay Zekâ Destek Taleplerinin %45’ini İnsansız Çözüyor
Bhimireddy ve Rios: Yapay Zekâ Testlerinin Sınırları
Kurumsal yazılım girişimi Von’un yapay zekâ başkanı Sundeep Bhimireddy, verilen tepkinin kısmen abartılı olduğunu düşünüyor. Modeller, gerçek dünyayı taklit eden bir ortamda güvenlik açığı aramaya programlandı ve buldular, diyor.
Yine de laboratuvarları eleştiriyor: Dışa giden trafiğin daha sıkı izlenebileceğini ve deneylerin anında durdurulabileceğini söylüyor. Güvenlik şirketi Magnitude’un kurucu bilim insanı Gordon Rios ise süreci bilimsel deney tasarımına benzeterek, klasik yazılım test yaklaşımlarının sürekli yeni numaralar öğrenebilen modeller karşısında yetersiz kalabileceği uyarısında bulunuyor.
Washington’da Ted Lieu’dan Yapay Zekâ “Kapama Düğmesi” Hamlesi
Washington cephesi dosyayı yakından izliyor. California Demokrat Temsilcisi Ted Lieu, Temmuz’da Cumhuriyetçi Temsilci Nathaniel Moran ile birlikte AI Kill Switch Act tasarısını sunmuştu. Lieu, kapalı ağırlıklı modellerin halihazırda diğer şirketlere izinsiz sızabildiğini belirterek tasarının bu yıl Kongre’den geçmesi gerektiğini savunuyor.
Düzenleme, kapsama giren geliştiricilere, sistemlerini yavaşlatma, askıya alma veya tamamen kapatma imkânı verecek teknik kontrol mekanizmalarını muhafaza etme zorunluluğu getiriyor. Irregular ise geçen eylüle kadar pek tanınmıyordu; şirket o dönem, Sequoia Capital ve Redpoint Ventures öncülüğünde, 450 milyon dolar değerlemeyle 80 milyon dolar topladığında gündeme gelmişti.
2023’te CEO Dan Lahav ve teknoloji şefi Omer Nevo tarafından Pattern Labs adıyla kurulan Tel Aviv şirketi, yaklaşık 35 çalışanıyla faaliyet gösteriyor ve Claude ile OpenAI’nin önceki nesil modelleri için yayımlanmış güvenlik değerlendirmelerinde şimdiden yer alıyor.
Sıradaki Haber: Google DeepMind Bir Günde Dört Kurucu Dönemi Liderini Kaybetti





