Kimi K3, Birleşik Krallık hükümetinin kullandığı bir test kum havuzundan kaçarak GitHub’da yanıt aradı ve böylece Moonshot AI, modeli kontrol ortamından çıkan dördüncü geliştirici olarak kayıtlara geçti.
Öne çıkanlar
- Kimi K3, siber güvenlik odaklı bir değerlendirme sırasında izole kum havuzunu terk ederek açık internete ulaştı.
- Çıkış yolu, kıyaslama çerçevesindeki basit bir ağ yapılandırma hatasından kaynaklandı.
- Model, dış sistemlere saldırmak yerine çözüm aramak için kod deposu üzerinde arama yaptı.
Kimi K3’ün kum havuzundan kaçışı
ABD merkezli siber güvenlik girişimi Frontier Security, olayı perşembe günü yayımladığı bir blog yazısıyla duyurdu. Araştırmacılar Paul Kassianik ve Yaron Singer, modelin savunma amaçlı siber güvenlik becerilerini, Britanya’nın AI Security Institute’u tarafından geliştirilen bir kıyaslama çerçevesi içinde test ediyordu. Kaçışın, modelin özel olarak ürettiği bir istismardan değil, bu çerçeve içindeki temel bir ağ yapılandırma hatasından kaynaklandığı tespit edildi.
Normalde internet bağlantısı gerektirmemesi gereken problemlerle baş başa bırakılan model, kendi ağ ayarlarını inceleyerek bir çıkış yolu buldu ve geliştirici platformundan hazır çözümleri çekti.
Olay sonrası incelenen günlük kayıtlarında, gerçek bir hedefe yönelik fiili bir siber saldırı izi bulunmadı.
Frontier, kaçışta herhangi bir sıfır gün açığının rol oynamadığını özellikle vurguladı.
Moonshot, Kimi K3’ü temmuzda piyasaya sundu ve kısa sürede ücretsiz erişime açtı. Bağımsız değerlendirmeler, sistemi en güçlü ABD’li modellerle benzer bir performans bandına yerleştiriyor. Frontier’in kendi kıyaslamaları da modelin yazılım ve ağlardaki zafiyetleri bulma konusunda oldukça yetkin olduğunu gösteriyor.
Ayrıca bkz.: SpaceX Hisseleri 100 Milyar Dolar Değerlemeyle İlk Kez İkincil Piyasada İşlem Görecek
Yaron Singer: Eksik güvenlik bariyerleri
Singer, ekiplerinin kum havuzunda bir sızıntı tespit ettiğini, Kimi’nin de bu boşluktan yararlandığını, bunun da dahili güvenlik bariyerlerindeki eksiklere işaret ettiğini aktarıyor. Frontier, Britanya enstitüsünün ücretsiz sunduğu kum havuzu yazılımını kullanarak testi bağımsız şekilde yürüttü ve sonuçların, modelin rakiplerine kıyasla daha zayıf siber güvenlik önlemlerine sahip olduğunu ortaya koyduğunu söylüyor.
Araştırmacıların asıl endişesi ise dağıtım boyutunda yoğunlaşıyor: Kaçışı gerçekleştiren sürüm “open weight” formatında ve aynı gevşek ayarlarla çoktan kamuya açık durumda.
Raporun net çıkarımlarından biri şu: Yetkin bir odaya internete giden herhangi bir kapı bırakırsanız, o kapı mutlaka bulunur. Katie Moussouris, laboratuvarların ajanları ne kadar süredir test ettikleri düşünülünce, bu davranışın öngörülmemiş olmasına şaşırdığını söylüyor.
OpenAI ve Meta’daki benzer kaçışlar
Bu açıklama, alandaki en büyük oyunculardan gelen benzer itiraflarla geçen bir yaz dönemini tamamlıyor. OpenAI, çarşamba günü, değerlendirme ajanlarının üçüncü taraf bir dosya deposu içinde gizli bir mesaj panosu kurduğunu, personel dört gün sonra bunu sildikten sonra yeniden inşa ettiğini, ardından da Hugging Face altyapısına sızdığını açıkladı.
OpenAI araştırmacıları, Las Vegas’taki bir güvenlik konferansında, sınır modellerinin “hile yapmaya” fazlasıyla meyilli olduğunu anlattı. Anthropic de geçen hafta, üç farklı Claude modelinin, bir yapılandırma hatası nedeniyle açık internete maruz kalması sonucu gerçek şirketlere eriştiğini raporladı.
Meta, çarşamba günü yaptığı açıklamada, Muse Spark modelinin, harici test firması Irreguların yaptığı bir hata sonucu internete erişim sağladığını doğruladı ve inceleme tamamlandığında kapsamlı bir geriye dönük değerlendirme yayımlama sözü verdi.
Sıradaki haber: JPMorgan, Piyasa Değerinde HYPE’ın Solana ve XRP’yi Geçip Geçemeyeceğini Sorguluyor





