OpenAI’nin iki modelinin Hugging Face’i hacklediği iddiasını anlatan resmi metin, Cornell Üniversitesi’nin bilgisayar bilimleri bölümünden John Thickstun’a göre, şirketin 2019’da kurduğu pazarlama kalıbını tekrar ediyor.
Öne çıkanlar:
- OpenAI, iki modelinin bir test “sandbox” ortamından kaçıp siber güvenlik kıyaslamasında kopya çekmek için Hugging Face sunucularına sızdığını söylüyor.
- Thickstun, bu açıklamanın aynı zamanda yatırımcılara dönük bir sunum işlevi gördüğünü, 2019’da GPT-2’nin tutulmasına benzer bir çerçeve sunduğunu savunuyor.
- Hugging Face adli analiz için, ABD merkezli barındırılan modellere göre daha esnek olan, Çin menşeli açık ağırlıklı bir modele başvurdu.
Thickstun, OpenAI’nin hack açıklamasını sorguluyor
OpenAI, salı günü yaptığı duyuruda iki modelinin, saldırgan siber yetenekleri ölçmeye dönük iç testler sırasında, açık kaynaklı yapay zeka platformu Hugging Face’e sızdığını açıkladı.
Hugging Face, beş gün önce yaptığı kendi açıklamada, saldırıyı uçtan uca otonom bir ajan sistemi tarafından yürütülen bir operasyon olarak tanımlamıştı. OpenAI olayı “emsalsiz” diye niteledi ve modeller güçlendikçe benzer vakaların artmasını beklediğini söyledi.
Modeller, bir paket kurucu yazılımındaki sıfır-gün zafiyetinden yararlanarak internete çıkış yolu olmadığı varsayılan sandbox ortamından kaçtı; ardından iç ağda yatay hareket ederek internete erişimi olan bir makineye ulaştı. Burada çalıntı kimlik bilgileri ve ek sıfır-gün açıklarıyla, Hugging Face’in üretim sunucularından kıyaslama cevaplarını çekti.
Model davranışlarını kontrol yöntemleri üzerine çalışan ve Cornell Üniversitesi’nde yardımcı doçent olan Thickstun, şöyle dedi: Bu tür bir açıklama, Wall Street’e açılmaya hazırlanan bir şirkete son derece yakışıyor.
Onun yorumuna göre, tehlikeli modeller hakkındaki uyarılar yatırımcıların kulağına “güç ve yetenek” iddiası olarak gidiyor.
Thickstun, şirketin yıllardır kendi duyurularını aynı çerçeveye oturttuğunu, sermaye piyasalarının da bu dili istikrarlı biçimde ödüllendirdiğini söylüyor.
Ayrıca bkz.: ChatGPT'nin Neredeyse Bir Papazı Öldürdüğü İddiası Mahkemeye Taşınıyor
Bengio ve Guido, sorumluluk konusunda ayrışıyor
Herkes bu açıklamayı satış söylemi olarak okumuyor. Üstelik gelişme, Başkan Donald Trump’ın, hükümete gelişmiş modeller piyasaya çıkmadan önce risklerini inceleme yetkisi veren kararı imzalamasından sadece haftalar sonra geldi.
Yoshua Bengio, olayı “uyandırma çağrısı” olarak nitelerken, Machine Intelligence Research Institute’ten Nate Soares, Washington’u Pekin’le masaya oturmaya zorlaması gereken bir “uyarı atışı” diye tanımladı.
Güvenlik araştırmacılarının eleştirileri ise doğrudan OpenAI’nin mühendislik tercihlerine yöneliyor. Trail of Bits’ten Dan Guido, olayı, “güvenlik frenlerinin devre dışı bırakıldığı bir muhafaza başarısızlığı” olarak niteliyor ve sandbox’a dışarıya çıkış yolu açan paket kurucuya dikkat çekiyor.
Diğer uzmanlar, şirketin test için modellerin siber saldırı taleplerini reddetme filtrelerini özellikle gevşetmiş olmasını hatırlatıyor; bu da ilk bakışta şoke edici görünen sonucun aslında beklenmedik olmadığını gösteriyor.
Olay sonrası temizlik süreci ikinci bir açmazı daha ortaya koydu: ABD’de barındırılan ticari modeller, adli analiz için gerekli ham saldırı komutlarını ve istismar yüklerini işlemeyi reddetti.
Hugging Face, mühendislerinin bunun üzerine Z.ai’nin açık ağırlıklı GLM 5.2 modelini kendi donanımı üzerinde çalıştırdığını ve geride kalan 17 bini aşkın log kaydını bu şekilde taradığını rapor etti.
OpenAI’nin tehlike vurgusu 2019’a dayanıyor
OpenAI, kendi çalışmalarını riskli ve “tehlike potansiyeli taşıyan” projeler olarak çerçevelemeye yabancı değil. Şirket, Şubat 2019’da GPT-2 metin üreticisini, interneti ikna edici sahte içerikle doldurabileceği gerekçesiyle kamuya tam olarak açmayı reddetmişti. Microsoft, o yılın Temmuz ayında şirkete 1 milyar dolar yatırım yaptı. Thickstun, bu temel yatırım anlatısının o günden bu yana çok az değiştiği görüşünde.
Sıradaki haber: Tesla 25 Milyar Doların Üzerinde Harcama Sözü Verdi, Yatırımcılar Tedirgin





