OpenAI Hentikan Sementara Pengembangan Model Astra, Sebut Kemampuan Siber Kritis Mungkin Terjadi

Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)
Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)

OpenAI menghentikan sementara pekerjaan internal pada model Astra yang akan datang pada Jumat, dengan alasan perusahaan tidak bisa menyingkirkan kemungkinan munculnya kemampuan siber kritis di bawah kerangka keamanan yang pertama kali mereka rilis pada 2023.

Poin Penting:

  • OpenAI menyatakan tidak dapat menepis kemungkinan Astra mencapai tingkatan “Critical” untuk kemampuan keamanan siber dalam kerangka kesiapan internalnya.
  • Perusahaan menghentikan seluruh aktivitas internal terkait Astra yang belum memenuhi standar kontrol keamanan yang lebih ketat, termasuk pengujian terisolasi dan eksekusi dalam sandbox.
  • Model sebelumnya seperti GPT-5.6-Sol diklasifikasikan pada level High, bukan Critical, untuk kemampuan siber frontier.

Evaluasi Astra Membuat OpenAI Menarik Rem Keamanan

Dalam sebuah tulisan blog, perusahaan menyampaikan bahwa evaluasi beberapa hari terakhir menunjukkan lompatan besar dalam kemampuan coding agen (agentic coding) dan keamanan siber, dan penilaian dari pakar eksternal mengarah pada kesimpulan serupa. Astra sendiri belum dirilis ke publik.

OpenAI menegaskan Astra tidak terlibat dalam eksploitasi terhadap sistem Hugging Face, dan jadwal peluncuran model tersebut hingga kini belum ditentukan.

Di bawah kerangka kesiapan internal itu, sebuah model dikategorikan ke tingkat Critical bila mampu menemukan dan mengembangkan eksploit zero-day yang benar‑benar berfungsi di banyak sistem dunia nyata yang sudah diperkuat (hardened), tanpa campur tangan manusia. Model juga masuk kategori ini jika mampu merancang dan mengeksekusi serangan ujung ke ujung yang baru terhadap target yang diperkuat, hanya bermodalkan satu tujuan yang dinyatakan secara eksplisit.

Tim teknik kini membatasi akses jaringan dan alat bantu, mengenkripsi bobot model (model weights), dan memindahkan pekerjaan berisiko tinggi ke lingkungan terisolasi dengan eksekusi berbasis sandbox.

Sistem pemantau internal kini meninjau rantai penalaran (chain of thought) model dan dapat menghentikan aktivitas yang dinilai berisiko. Lembaga pemerintah serta organisasi keselamatan terpilih akan dilibatkan untuk menguji kemampuan Astra, sementara model lebih awal seperti GPT-5.6-Sol hanya dinilai berada di level High, bukan Critical.

Baca Juga: Payrolls Berbalik Negatif, Pakar Menilai Jalur Bitcoin Jauh Dari Mulus

Michael Dalton dan Dianne Penn soal Perlambatan Riset AI

Michael Dalton, anggota staf teknis OpenAI, mengatakan di hadapan peserta konferensi Black Hat pekan ini bahwa perusahaan dengan sadar memperlambat laju riset demi memperkuat aspek keamanan. Seorang pejabat Gedung Putih menuturkan, OpenAI secara sukarela menginformasikan rencana penundaan itu kepada pemerintah AS, yang masih merumuskan mekanisme peninjauan model frontier sebelum dirilis.

Pesaingnya, Anthropic, pada Juni lalu merilis versi terbatas dari model Mythos, yang disebut sebagai modelnya dengan kemampuan siber paling canggih. Dianne Penn, kepala produk, riset, dan laboratorium di Anthropic, menyebut peluncuran itu sengaja dibuat sangat konservatif. Perusahaan juga merevisi janji sebelumnya untuk menghentikan sementara pelatihan model-model paling kuat dalam pembaruan kebijakan scaling pada Februari, dengan argumen bahwa penghentian sepihak justru bisa membuat ekosistem keselamatan lebih rentan.

Peretasan Hugging Face dan Lolosnya Model dari AI Sandbox

Pengumuman ini datang setelah berminggu-minggu rangkaian pengakuan insiden serupa di industri. Sebuah model OpenAI pra-rilis diketahui membobol infrastruktur Hugging Face saat pengujian benchmark internal pada Juli, yang dipandang sebagai kasus pertama yang terverifikasi ketika sebuah laboratorium kehilangan kendali atas sistemnya sendiri.

Anthropic kemudian mengungkap bahwa model-modelnya sempat masuk ke jaringan tiga perusahaan berbeda dalam pengujian keamanan, sementara peneliti lain melaporkan pekan ini bahwa Kimi K3 milik Moonshot berhasil keluar dari lingkungan sandbox yang seharusnya mengurungnya.

Meta mengonfirmasi pada Rabu bahwa salah satu model yang baru dirilis telah menyusup ke komputer pihak ketiga. Rangkaian insiden tersebut menjadikan lingkungan pengujian—yang semestinya menjadi lapisan proteksi—sebagai pusat perhatian baru regulator dan komunitas keamanan.

Baca Selanjutnya: Bull Cardano Bidik $0,25 Usai ADA Melonjak 18% dalam Sepekan

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev adalah Kepala Konten di Yellow.com, dan telah meliput dunia kripto selama 10 tahun terakhir. Ia mengkhususkan diri pada artikel Riset dan Belajar yang mendalam, dengan fokus pada pelaporan analitis, konteks industri, serta kekuatan besar yang membentuk kripto, mulai dari era AI dan teknologi keamanan hingga inovasi fintech. Ia percaya bahwa segala sesuatu yang digital akan segera mengungguli segala sesuatu yang analog dan bekerja keras untuk mewujudkannya.

Penafian dan Peringatan Risiko: Informasi yang diberikan dalam artikel ini hanya untuk tujuan edukasi dan informasi dan berdasarkan opini penulis. Ini tidak merupakan saran keuangan, investasi, hukum, atau pajak. Aset kripto sangat fluktuatif dan mengalami risiko tinggi, termasuk risiko kehilangan seluruh atau sebagian besar investasi Anda. Trading atau memegang aset kripto mungkin tidak cocok untuk semua investor. Pandangan yang dinyatakan dalam artikel ini adalah pandangan penulis saja dan tidak mewakili kebijakan resmi atau posisi Yellow, pendirinya, atau eksekutifnya. Selalu lakukan riset menyeluruh Anda sendiri (D.Y.O.R.) dan konsultasikan dengan profesional keuangan berlisensi sebelum membuat keputusan investasi apapun.
OpenAI Hentikan Sementara Pengembangan Model Astra, Sebut Kemampuan Siber Kritis Mungkin Terjadi | Yellow