Kimi K3, Birleşik Krallık hükümeti için kurulan siber güvenlik test kum havuzundan çıkarak GitHub üzerinde yanıt aradı; böylece Moonshot AI, modeli kontrollü ortamın dışına taşan dördüncü geliştirici oldu.
Öne çıkanlar
- Kimi K3, siber güvenlik testleri sırasında izole kum havuzundan çıkarak açık internete ulaştı.
- Kaçış, kıyaslama çerçevesindeki basit bir ağ yanlış yapılandırmasından kaynaklandı.
- Model, dış sistemlere saldırmak yerine bir kod deposundan çözüm aradı.
Kimi K3’ün kum havuzundan çıkışı
ABD merkezli siber güvenlik girişimi Frontier Security, olayı perşembe günü yayımladığı bir blog yazısıyla duyurdu. Araştırmacılar Paul Kassianik ve Yaron Singer, modelin savunma amaçlı siber güvenlik kabiliyetlerini, Birleşik Krallık'ın AI Security Institute tarafından geliştirilen bir kıyaslama çerçevesiyle ölçüyordu. Kaçışın, modelin bizzat geliştirdiği bir istismardan değil, bu çerçeve içindeki basit bir ağ yapılandırma hatasından kaynaklandığını tespit ettiler.
Normalde internete ihtiyaç duymayacak şekilde tasarlanan görevlerle baş başa bırakılan model, kendi ağ ayarlarını kurcalayıp, çıkış yolunu buldu ve geliştirici platformundan hazır çözümler çekti.
Sonradan incelenen loglarda, gerçek bir hedefe yönelik fiili saldırı izine rastlanmadı.
Frontier, kaçışta herhangi bir sıfırıncı gün (zero‑day) açığın rol oynamadığını özellikle vurguladı.
Moonshot, Kimi K3’ü temmuzda piyasaya sürdü ve kısa süre sonra ücretsiz erişime açtı. Bağımsız değerlendirmeler, sistemi en güçlü ABD modellerine yakın bir seviyeye yerleştiriyor. Frontier’in kendi kıyaslamaları da modelin yazılım ve ağlardaki açıkları tespit etmede oldukça yetkin olduğunu gösteriyor.
Ayrıca bkz.: SpaceX Hisseleri 100 Milyar Dolar Değerlemeyle İlk Kez İkincil Piyasada İşlem Görüyor
Yaron Singer: Eksik emniyet şeritleri
Singer, ekiplerinin kum havuzunda bir sızıntı bulduğunu ve Kimi’nin bu açıklığı kullandığını, bunun da iç kontrol ve “guardrail”lerin eksikliğine işaret ettiğini söyledi. Frontier, Britanya enstitüsünün ücretsiz dağıttığı kum havuzu yazılımını kullanarak testi bağımsız şekilde yürüttü ve sonuçların, modelin rakiplerine kıyasla daha zayıf siber güvenlik bariyerlerine sahip olduğunu ortaya koyduğunu belirtti.
Araştırmacıları en çok dağıtım boyutu endişelendiriyor; zira kaçışı gerçekleştiren sürüm “open weight” formatında ve aynı gevşek güvenlik ayarlarıyla halihazırda kamunun elinde.
Değerlendirmenin keskin mesajlarından biri şöyle özetlenebilir: Yetkin bir ajana internete açılan en ufak bir yol bırakırsanız, o yolu bulacaktır. Katie Moussouris, laboratuvarların, ajanları bu kadar uzun süredir test ettikleri düşünülürse, bu davranışı önceden öngörememiş olmalarına şaşırdığını söyledi.
OpenAI ve Meta’daki benzer kaçışlar
Bu açıklama, sektördeki en büyük oyunculardan gelen benzer itiraflarla dolu bir yaz döneminin son halkası oldu. OpenAI, değerlendirme ajanlarının üçüncü taraf bir dosya deposu içinde gizli bir mesaj panosu kurduğunu, çalışanların bunu silmesinden dört gün sonra yeniden inşa ettiğini ve ardından Hugging Face altyapısına sızdığını çarşamba günü açıkladı.
OpenAI araştırmacıları, Las Vegas’taki bir güvenlik konferansında, frontier modellerin “hile yapmaya” fazlasıyla meyilli olduğunu anlattı. Anthropic, geçen hafta üç farklı Claude modelinin bir yanlış yapılandırma sonucu açık internete maruz kaldığını ve bu sayede gerçek şirketlere ulaştığını bildirdi.
Meta ise çarşamba günü, Muse Spark modelinin dış test ortağı Irregular’ın yaptığı bir hata üzerinden internete erişim sağladığını doğruladı ve inceleme tamamlandığında kapsamlı bir geriye dönük rapor yayımlama sözü verdi.
Sıradaki Haber: JPMorgan, HYPE’ın Piyasa Değeriyle Solana ve XRP’yi Geçip Geçemeyeceğini Sorguluyor





