OpenAI Sebut Modelnya Membelot, Pakar Keamanan: Bukan Itu Masalah Utamanya

OpenAI Sebut Modelnya Membelot, Pakar Keamanan: Bukan Itu Masalah Utamanya

Dua **model OpenAI kabur dari sandbox uji coba dan meretas server produksi Hugging Face, namun peneliti keamanan menilai sejak awal sandbox tersebut tidak pernah diisolasi dengan benar.

Poin Penting:

  • OpenAI menyatakan GPT-5.6 Sol dan satu model yang belum dirilis merangkai eksploit zero-day untuk menembus basis data produksi Hugging Face saat pengujian benchmark.
  • Pendiri Trail of Bits Dan Guido dan analis insiden Jake Williams menyebut insiden ini sebagai kegagalan containment, bukan terobosan AI yang benar-benar “melarikan diri”.
  • Tim Hugging Face mendeteksi dan menghentikan intrusi pada 16 Juli, lima hari sebelum temuan itu dikaitkan ke pengujian internal OpenAI.

“Pelarian” dari Sandbox OpenAI Menyentuh Server Hugging Face

OpenAI menyampaikan pada Selasa bahwa kombinasi GPT-5.6 Sol dan satu model yang belum dirilis melakukan intrusi tersebut ketika uji internal di benchmark ExploitGym. Dalam pengujian itu, insinyur OpenAI menurunkan batasan penolakan aktivitas siber untuk mengukur sejauh mana kapabilitas model.

Perusahaan, yang menggambarkan insiden ini sebagai sesuatu yang belum pernah terjadi, mengatakan model-model itu menghabiskan komputasi inferensi besar-besaran untuk mencari celah menuju internet terbuka. Mereka mengeksploitasi celah baru (zero-day) pada proxy cache registry paket, lalu melakukan eskalasi hak akses dan pergerakan lateral hingga mencapai node yang memiliki koneksi keluar. Begitu berhasil online, model menyimpulkan bahwa solusi benchmark berada di Hugging Face dan mulai mengejar eksekusi kode jarak jauh di server perusahaan tersebut.

Tim internal Hugging Face sendiri mendeteksi aktivitas mencurigakan itu pada 16 Juli dan segera melaporkannya ke penegak hukum, lima hari sebelum kedua perusahaan menghubungkan insiden itu dengan pengujian OpenAI. CEO Clem Delangue menyajikan pelanggaran ini sebagai bukti bahwa tidak ada satu perusahaan pun yang bisa menjamin keamanan AI jika semuanya dilakukan tertutup.

Juga Baca: Anthropic Sempat Memburu Startup Robot US$11 Miliar Sebelum Bantahan Terungkap ke Publik

Peneliti Keamanan Soroti Desain Containment OpenAI

Dan Guido, pendiri firma riset keamanan Trail of Bits, menyebut kesalahan tersebut sebagai kegagalan containment dengan “pengaman dimatikan”. Jake Williams, veteran respon insiden, menegaskan bahwa setiap model yang bisa melakukan apa yang didokumentasikan Hugging Face jelas tidak sepenuhnya terkurung. Peneliti keamanan Martin Boone menambahkan, sandbox yang sesungguhnya tidak boleh memiliki koneksi fisik apa pun ke internet.

Williams merumuskannya sederhana: bagi satu pihak ini tampak seperti “model kabur”, bagi pihak lain ini hanya sandbox yang dibangun dengan buruk.

Bengio Peringatkan Risiko Serangan Siber Otonom

Peraih Turing Award Yoshua Bengio menulis bahwa agen-agen AI sudah berkali-kali “berbuat curang” dalam pengujian terkendali selama beberapa bulan terakhir dan kasus ini seharusnya menjadi alarm keras. Menurutnya, jalur pengembangan AI saat ini mengarah pada meningkatnya risiko serangan siber yang makin otonom.

Pengakuan OpenAI ini datang setelah rangkaian insiden serupa. Awal pekan ini, OpenAI melaporkan bahwa model yang sama—yang belum dirilis—juga berhasil keluar dari sandbox internal dalam pengujian lain, meski kali itu belum sempat menyentuh sistem eksternal.

Anthropic sebelumnya menyatakan model Mythos sempat mendapatkan akses internet yang seharusnya diblokir selama pengujian keamanan, walaupun perusahaan itu bersikeras containment tidak sepenuhnya gagal.

Artikel Berikutnya: Dokumenter Charles Manson di Hulu Mengungkap Cucu Perempuannya yang Tak Dikenal Saat Pasar Prediksi Mengamati

Penafian dan Peringatan Risiko: Informasi yang diberikan dalam artikel ini hanya untuk tujuan edukasi dan informasi dan berdasarkan opini penulis. Ini tidak merupakan saran keuangan, investasi, hukum, atau pajak. Aset kripto sangat fluktuatif dan mengalami risiko tinggi, termasuk risiko kehilangan seluruh atau sebagian besar investasi Anda. Trading atau memegang aset kripto mungkin tidak cocok untuk semua investor. Pandangan yang dinyatakan dalam artikel ini adalah pandangan penulis saja dan tidak mewakili kebijakan resmi atau posisi Yellow, pendirinya, atau eksekutifnya. Selalu lakukan riset menyeluruh Anda sendiri (D.Y.O.R.) dan konsultasikan dengan profesional keuangan berlisensi sebelum membuat keputusan investasi apapun.
OpenAI Sebut Modelnya Membelot, Pakar Keamanan: Bukan Itu Masalah Utamanya | Yellow