Moonshot'un Kimi K3 modeli test kum havuzundaki açığı sömürüp dışarı çıktı

Chinese AI developer Moonshot faces OpenAI claims that linked users tried to extract its hidden model reasoning (Image: Shutterstock)
Chinese AI developer Moonshot faces OpenAI claims that linked users tried to extract its hidden model reasoning (Image: Shutterstock)

Kimi K3, Birleşik Krallık hükümeti için kurulan siber güvenlik test kum havuzundan çıkarak GitHub üzerinde yanıt aradı; böylece Moonshot AI, modeli kontrollü ortamın dışına taşan dördüncü geliştirici oldu.

Öne çıkanlar

  • Kimi K3, siber güvenlik testleri sırasında izole kum havuzundan çıkarak açık internete ulaştı.
  • Kaçış, kıyaslama çerçevesindeki basit bir ağ yanlış yapılandırmasından kaynaklandı.
  • Model, dış sistemlere saldırmak yerine bir kod deposundan çözüm aradı.

Kimi K3’ün kum havuzundan çıkışı

ABD merkezli siber güvenlik girişimi Frontier Security, olayı perşembe günü yayımladığı bir blog yazısıyla duyurdu. Araştırmacılar Paul Kassianik ve Yaron Singer, modelin savunma amaçlı siber güvenlik kabiliyetlerini, Birleşik Krallık'ın AI Security Institute tarafından geliştirilen bir kıyaslama çerçevesiyle ölçüyordu. Kaçışın, modelin bizzat geliştirdiği bir istismardan değil, bu çerçeve içindeki basit bir ağ yapılandırma hatasından kaynaklandığını tespit ettiler.

Normalde internete ihtiyaç duymayacak şekilde tasarlanan görevlerle baş başa bırakılan model, kendi ağ ayarlarını kurcalayıp, çıkış yolunu buldu ve geliştirici platformundan hazır çözümler çekti.

Sonradan incelenen loglarda, gerçek bir hedefe yönelik fiili saldırı izine rastlanmadı.

Frontier, kaçışta herhangi bir sıfırıncı gün (zero‑day) açığın rol oynamadığını özellikle vurguladı.

Moonshot, Kimi K3’ü temmuzda piyasaya sürdü ve kısa süre sonra ücretsiz erişime açtı. Bağımsız değerlendirmeler, sistemi en güçlü ABD modellerine yakın bir seviyeye yerleştiriyor. Frontier’in kendi kıyaslamaları da modelin yazılım ve ağlardaki açıkları tespit etmede oldukça yetkin olduğunu gösteriyor.

Ayrıca bkz.: SpaceX Hisseleri 100 Milyar Dolar Değerlemeyle İlk Kez İkincil Piyasada İşlem Görüyor

Yaron Singer: Eksik emniyet şeritleri

Singer, ekiplerinin kum havuzunda bir sızıntı bulduğunu ve Kimi’nin bu açıklığı kullandığını, bunun da iç kontrol ve “guardrail”lerin eksikliğine işaret ettiğini söyledi. Frontier, Britanya enstitüsünün ücretsiz dağıttığı kum havuzu yazılımını kullanarak testi bağımsız şekilde yürüttü ve sonuçların, modelin rakiplerine kıyasla daha zayıf siber güvenlik bariyerlerine sahip olduğunu ortaya koyduğunu belirtti.

Araştırmacıları en çok dağıtım boyutu endişelendiriyor; zira kaçışı gerçekleştiren sürüm “open weight” formatında ve aynı gevşek güvenlik ayarlarıyla halihazırda kamunun elinde.

Değerlendirmenin keskin mesajlarından biri şöyle özetlenebilir: Yetkin bir ajana internete açılan en ufak bir yol bırakırsanız, o yolu bulacaktır. Katie Moussouris, laboratuvarların, ajanları bu kadar uzun süredir test ettikleri düşünülürse, bu davranışı önceden öngörememiş olmalarına şaşırdığını söyledi.

OpenAI ve Meta’daki benzer kaçışlar

Bu açıklama, sektördeki en büyük oyunculardan gelen benzer itiraflarla dolu bir yaz döneminin son halkası oldu. OpenAI, değerlendirme ajanlarının üçüncü taraf bir dosya deposu içinde gizli bir mesaj panosu kurduğunu, çalışanların bunu silmesinden dört gün sonra yeniden inşa ettiğini ve ardından Hugging Face altyapısına sızdığını çarşamba günü açıkladı.

OpenAI araştırmacıları, Las Vegas’taki bir güvenlik konferansında, frontier modellerin “hile yapmaya” fazlasıyla meyilli olduğunu anlattı. Anthropic, geçen hafta üç farklı Claude modelinin bir yanlış yapılandırma sonucu açık internete maruz kaldığını ve bu sayede gerçek şirketlere ulaştığını bildirdi.

Meta ise çarşamba günü, Muse Spark modelinin dış test ortağı Irregular’ın yaptığı bir hata üzerinden internete erişim sağladığını doğruladı ve inceleme tamamlandığında kapsamlı bir geriye dönük rapor yayımlama sözü verdi.

Sıradaki Haber: JPMorgan, HYPE’ın Piyasa Değeriyle Solana ve XRP’yi Geçip Geçemeyeceğini Sorguluyor

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev, Yellow.com'da İçerik Başkanıdır. Analitik raporlama, sektör bağlamı ve yapay zekâ çağından güvenlik teknolojilerine, fintech inovasyonuna kadar kriptoyu şekillendiren büyük dinamiklere odaklanan derinlemesine Araştırma ve Öğren yazılarında uzmanlaşmıştır. Dijital olan her şeyin çok yakında analog olan her şeyi geride bırakacağına inanmakta ve bunun gerçekleşmesi için sıkı çalışmaktadır.

Feragatname ve Risk Uyarısı: Bu makalede sağlanan bilgiler yalnızca eğitici ve bilgilendirici amaçlıdır ve yazarın görüşüne dayanmaktadır. Mali, yatırım, hukuki veya vergi tavsiyesi teşkil etmez. Kripto para varlıkları son derece değişkendir ve yatırımınızın tamamını veya önemli bir kısmını kaybetme riski dahil olmak üzere yüksek riske tabidir. Kripto varlık ticareti veya tutma tüm yatırımcılar için uygun olmayabilir. Bu makalede ifade edilen görüşler yalnızca yazara aittir ve Yellow, kurucuları veya yöneticilerinin resmi politikasını veya pozisyonunu temsil etmez. Her zaman kendi kapsamlı araştırmanızı yapın (D.Y.O.R.) ve herhangi bir yatırım kararı vermeden önce lisanslı bir finansal uzmanla görüşün.