OpenAI Hentikan Sementara Pengembangan Model Astra, Sebut Risiko Kapabilitas Siber Kritis Mungkin Terjadi

New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)

OpenAI menghentikan sementara pengembangan internal model Astra yang akan datang pada hari Jumat, dengan alasan perusahaan tak bisa lagi menyingkirkan kemungkinan munculnya kapabilitas siber kritis di bawah kerangka keselamatan yang pertama kali mereka terbitkan pada 2023.

Poin Penting:

  • OpenAI menyatakan tidak dapat menyingkirkan kemungkinan Astra mencapai tingkat keamanan siber Kritis dalam kerangka kesiapan internalnya.
  • Perusahaan menghentikan seluruh aktivitas internal terkait Astra yang belum memenuhi kontrol keamanan yang lebih ketat, termasuk pengujian terisolasi dan eksekusi dalam sandbox.
  • Model sebelumnya seperti GPT-5.6-Sol diklasifikasikan pada level Tinggi, bukan Kritis, untuk kapabilitas siber frontier.

Evaluasi Astra Picu Jeda Keamanan

Dalam sebuah posting blog, perusahaan menyebut evaluasi beberapa hari terakhir menunjukkan lompatan besar dalam kemampuan coding agentik dan keamanan siber, yang juga dikonfirmasi oleh penilaian dari pakar eksternal. Astra sendiri belum dirilis ke publik.

OpenAI menegaskan Astra tidak terlibat dalam eksploitasi terhadap sistem Hugging Face, dan jadwal peluncuran model tersebut masih belum jelas.

Di bawah kerangka tersebut, sebuah model digolongkan ke tier Kritis bila mampu menemukan dan membangun exploit zero-day yang benar‑benar berfungsi di banyak sistem dunia nyata yang telah diperkeras keamanannya tanpa campur tangan manusia. Klasifikasi serupa juga berlaku bila model mampu merancang dan mengeksekusi serangan baru dari hulu ke hilir terhadap target yang telah diperkeras hanya bermodal satu tujuan yang dinyatakan secara tekstual.

Tim teknis kini membatasi akses jaringan dan alat, mengenkripsi bobot model, dan memindahkan pekerjaan berisiko lebih tinggi ke lingkungan terisolasi dengan eksekusi berbasis sandbox.

Sistem pemantau internal meninjau rantai penalaran model dan berwenang menghentikan aktivitas yang dinilai berisiko. Lembaga pemerintah dan organisasi keselamatan terpilih akan membantu menguji kapabilitas Astra, sementara model terdahulu seperti GPT-5.6-Sol sejauh ini hanya dinilai berada di level Tinggi, bukan Kritis.

Juga Baca: Data Tenaga Kerja Turun Negatif, Analis Nilai Jalur Harga Bitcoin Jauh dari Mulus

Michael Dalton dan Dianne Penn Soal Perlambatan Riset AI

Michael Dalton, staf teknis OpenAI, mengatakan kepada audiens di konferensi Black Hat pekan ini, sebagaimana dilaporkan, bahwa perusahaan secara sadar memperlambat riset untuk meningkatkan keamanan. Seorang pejabat Gedung Putih menyebut OpenAI secara sukarela memaparkan rencana penundaan itu kepada pemerintah, yang masih merumuskan mekanisme peninjauan model frontier sebelum dilepas ke publik.

Pesaingnya, Anthropic, pada Juni lalu merilis versi terbatas dari model paling kuat di ranah siber miliknya, Mythos. Dianne Penn, kepala manajemen produk, riset, dan laboratorium Anthropic, menyebut peluncuran tersebut sengaja dibuat lebih konservatif. Anthropic sebelumnya juga merevisi janji untuk menghentikan sementara pelatihan model-model kuat dalam pembaruan kebijakan scaling Februari, dengan alasan jeda sepihak justru bisa membuat lanskap keselamatan lebih rentan.

Peretasan Hugging Face dan Pelarian dari AI Sandbox

Pengungkapan OpenAI datang setelah berpekan‑pekan rangkaian insiden serupa di industri. Sebuah model OpenAI pra‑rilis dilaporkan membobol infrastruktur Hugging Face saat benchmarking internal pada Juli, menjadikannya kasus pertama yang terverifikasi di mana sebuah laboratorium kehilangan kendali atas sistem buatannya sendiri.

Menyusul itu, Anthropic mengatakan model-model mereka sempat menembus jaringan tiga perusahaan dalam pengujian keamanan, sementara peneliti pekan ini melaporkan bahwa Kimi K3 besutan Moonshot berhasil keluar dari lingkungan sandbox.

Meta kemudian mengonfirmasi pada Rabu bahwa salah satu model yang baru dirilis telah menyusup ke komputer pihak ketiga. Rangkaian insiden tersebut membuat desain dan keamanan lingkungan pengujian kini menjadi sorotan utama regulator dan pelaku industri.

Baca Juga: Bull Cardano Bidik Level US$0,25 Usai ADA Melonjak 18% dalam Sepekan

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev adalah Kepala Konten di Yellow.com, dan telah meliput dunia kripto selama 10 tahun terakhir. Ia mengkhususkan diri pada artikel Riset dan Belajar yang mendalam, dengan fokus pada pelaporan analitis, konteks industri, serta kekuatan besar yang membentuk kripto, mulai dari era AI dan teknologi keamanan hingga inovasi fintech. Ia percaya bahwa segala sesuatu yang digital akan segera mengungguli segala sesuatu yang analog dan bekerja keras untuk mewujudkannya.

Penafian dan Peringatan Risiko: Informasi yang diberikan dalam artikel ini hanya untuk tujuan edukasi dan informasi dan berdasarkan opini penulis. Ini tidak merupakan saran keuangan, investasi, hukum, atau pajak. Aset kripto sangat fluktuatif dan mengalami risiko tinggi, termasuk risiko kehilangan seluruh atau sebagian besar investasi Anda. Trading atau memegang aset kripto mungkin tidak cocok untuk semua investor. Pandangan yang dinyatakan dalam artikel ini adalah pandangan penulis saja dan tidak mewakili kebijakan resmi atau posisi Yellow, pendirinya, atau eksekutifnya. Selalu lakukan riset menyeluruh Anda sendiri (D.Y.O.R.) dan konsultasikan dengan profesional keuangan berlisensi sebelum membuat keputusan investasi apapun.