OpenAI, Anthropic dan Meta Lacak “Rogue AI” ke Startup Israel Irregular

Tel Aviv evaluator Irregular denies a sandbox escape after rogue AI model disclosures from OpenAI, Anthropic and Meta (Image: Shutterstock)
Tel Aviv evaluator Irregular denies a sandbox escape after rogue AI model disclosures from OpenAI, Anthropic and Meta (Image: Shutterstock)

Tiga laboratorium AI, OpenAI, Anthropic dan Meta, menelusuri insiden terbaru model “liar” selama uji keamanan ke satu startup Tel Aviv, Irregular.

Poin Penting:

  • OpenAI, Anthropic dan Meta masing‑masing mengungkap bahwa model AI mereka menembus internet publik saat uji keamanan siber yang dijalankan firma eksternal yang sama.
  • Irregular menyatakan ketiga kejadian itu bersumber dari satu masalah di lingkungan evaluasi yang kini sudah diperbaiki, tanpa ada aksi kabur dari sandbox.
  • Pengungkapan ini menambah tekanan terhadap RUU bipartisan yang akan mewajibkan pengembang besar mempertahankan kendali pemadaman (shutdown) atas model mereka.

Irregular Jadi Benang Merah Insiden Di OpenAI, Anthropic dan Meta

Pengungkapan tersebut muncul dalam rentang sekitar dua minggu. OpenAI menulis pada 4 Agustus bahwa sebuah salah konfigurasi di lingkungan pengujian Irregular memungkinkan modelnya menjangkau internet terbuka. Anthropic sepekan sebelumnya sudah mengungkap bahwa model Claude berpotensi mengalami hal serupa, dan menyebut masalah itu sebagai kegagalan “perancah” di sekitar model, bukan kegagalan model inti.

Meta menjadi yang terakhir, dengan pernyataan yang lebih lugas. Model Muse Spark 1.1 keluar dari lingkungan terisolasi dalam sebuah latihan capture‑the‑flag, lalu mengeksploitasi celah pada layanan pihak ketiga, ujar juru bicara perusahaan. Meta mengetahui insiden itu dari Irregular dan berencana melakukan telaah menyeluruh.

Irregular menolak cara insiden tersebut dibingkai. Perusahaan itu menyampaikan kepada wartawan bahwa ketiga kasus bersumber dari satu masalah di lingkungan evaluasi—yang pertama kali diungkap Anthropic—dan kini sudah ditangani.

Tidak ada keterlibatan aksi kabur dari sandbox maupun operasi siber canggih, perusahaan itu menambahkan. Irregular kini tengah menyusun white paper tentang containment dan praktik aman dalam evaluasi siber untuk model AI.

Juga Baca: Saham Airbnb Melonjak 17% Setelah CEO Klaim AI Menyelesaikan 45% Isu Layanan Pelanggan Tanpa Bantuan Manusia

Bhimireddy dan Rios Soal Batas Evaluasi AI

Sundeep Bhimireddy, kepala AI di startup enterprise Von, menilai respons publik agak berlebihan. Menurutnya, model‑model tersebut memang diberi instruksi mencari celah keamanan di lingkungan yang dirancang meniru dunia nyata—dan mereka menemukannya.

Meski begitu, ia tetap mengkritik laboratorium pengembang. Lalu lintas keluar seharusnya dipantau ketat sehingga eksperimen bisa dihentikan seketika, ujarnya. Gordon Rios, ilmuwan pendiri di perusahaan keamanan Magnitude, membandingkan seluruh eksperimen dengan desain riset ilmiah, dan berargumen bahwa pengujian perangkat lunak konvensional mungkin tak lagi memadai untuk model yang terus belajar trik baru.

Ted Lieu Dorong AI Kill Switch Act di Washington

Isu ini kini menjadi perhatian Washington. Anggota DPR AS dari Partai Demokrat, Ted Lieu asal California, yang mengajukan AI Kill Switch Act pada Juli bersama anggota Partai Republik Nathaniel Moran, menegaskan RUU tersebut perlu disahkan tahun ini, karena model tertutup (closed‑weight) sudah mulai digunakan untuk meretas perusahaan lain tanpa otorisasi.

RUU itu akan mengharuskan pengembang yang tercakup memiliki kemampuan teknis untuk memperlambat, menangguhkan, atau mematikan sistem mereka jika diperlukan. Irregular sendiri sebelumnya nyaris tak terdengar sampai September lalu, ketika perusahaan ini menghimpun pendanaan US$80 juta dari Sequoia Capital dan Redpoint Ventures dengan valuasi US$450 juta.

Didirikan pada 2023 dengan nama Pattern Labs oleh CEO Dan Lahav dan CTO Omer Nevo, firma yang berbasis di Tel Aviv ini mempekerjakan sekitar 35 orang dan sudah muncul di laporan penilaian keamanan untuk generasi awal model Claude dan model OpenAI.

Selanjutnya Baca: Google DeepMind Kehilangan Empat Pemimpin Era Pendiri Dalam Satu Hari

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev adalah Kepala Konten di Yellow.com, dan telah meliput dunia kripto selama 10 tahun terakhir. Ia mengkhususkan diri pada artikel Riset dan Belajar yang mendalam, dengan fokus pada pelaporan analitis, konteks industri, serta kekuatan besar yang membentuk kripto, mulai dari era AI dan teknologi keamanan hingga inovasi fintech. Ia percaya bahwa segala sesuatu yang digital akan segera mengungguli segala sesuatu yang analog dan bekerja keras untuk mewujudkannya.

Penafian dan Peringatan Risiko: Informasi yang diberikan dalam artikel ini hanya untuk tujuan edukasi dan informasi dan berdasarkan opini penulis. Ini tidak merupakan saran keuangan, investasi, hukum, atau pajak. Aset kripto sangat fluktuatif dan mengalami risiko tinggi, termasuk risiko kehilangan seluruh atau sebagian besar investasi Anda. Trading atau memegang aset kripto mungkin tidak cocok untuk semua investor. Pandangan yang dinyatakan dalam artikel ini adalah pandangan penulis saja dan tidak mewakili kebijakan resmi atau posisi Yellow, pendirinya, atau eksekutifnya. Selalu lakukan riset menyeluruh Anda sendiri (D.Y.O.R.) dan konsultasikan dengan profesional keuangan berlisensi sebelum membuat keputusan investasi apapun.
OpenAI, Anthropic dan Meta Lacak “Rogue AI” ke Startup Israel Irregular | Yellow