Astra Raih Skor Sempurna 100% di Tolok Ukur Siber Tersulit OpenAI

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI pada Kamis mulai meluncurkan GPT-6 Astra, model pertama yang mereka kategorikan sebagai berisiko siber kritis setelah membukukan skor sempurna 100% di ExploitBench.

Poin Penting:

  • OpenAI merilis GPT-6 Astra pada Kamis, diawali untuk kalangan pembela siber terpilih dalam program Daybreak, diikuti akses untuk pengguna ChatGPT Plus, Pro, Business dan Enterprise dalam beberapa hari.
  • Model ini mencetak 100% di ExploitBench dan 98,6% di ARC-AGI-3, dibanding hanya 7,8% untuk GPT-5.6 Sol.
  • Pelatihan dijalankan di lebih dari 100.000 GPU di fasilitas Stargate di Texas, menjadi proses training terbesar perusahaan sejauh ini.

Skor Benchmark Astra

Perusahaan mengumumkan peluncuran bertahap.

Para pembela keamanan siber yang telah diseleksi melalui program Daybreak berbasis aplikasi menjadi pihak pertama yang mendapatkan akses ke model ini dalam bentuk paling minim pembatasan.

Pengguna ChatGPT Plus, Pro, Business dan Enterprise, lalu pengguna OpenAI API serta Amazon Web Services, akan menyusul dalam hitungan hari.

Astra mencetak skor 98,6% di ARC-AGI-3, uji penalaran dalam skenario yang belum pernah dilihat model sebelumnya, jauh di atas 7,8% untuk GPT-5.6 Sol dan 30% untuk Claude Opus 5 milik Anthropic. Astra juga meraih 97,6% di FrontierMath Tier 4, 96% di GPQA Diamond, dan 72,6% pada subset offline OSWorld 2.0, dengan waktu penyelesaian tugas sekitar 35 menit lebih cepat per tugas dibanding pendahulunya.

Proses pelatihan dijalankan di lebih dari 100.000 GPU di fasilitas Stargate, Texas. Ini menjadi sesi pelatihan terbesar yang pernah dilakukan OpenAI, dan angka kapasitas komputasi baru diungkap saat peluncuran. Untuk pertama kalinya, model-model lain juga memainkan peran signifikan dalam mengawasi proses training tersebut.

Juga Baca: XRP Ledger Diuji BIS dengan Publikasi Data 3–5 Detik

Klaim AGI dari Brockman

Presiden OpenAI Greg Brockman menutup sesi jumpa pers dengan pernyataan yang menjadi sorotan, mengatakan kepada wartawan, “Selamat datang di era AGI.” Ia menyebut Astra sebagai lompatan generasional dan menilai wajar jika model ini dibaca sebagai kecerdasan umum buatan (artificial general intelligence), target jangka panjang yang sudah lama dicanangkan perusahaan.

Kepala ilmuwan Jakub Pachocki mengambil nada yang lebih hati-hati. Ia mengatakan bahwa semakin canggih sebuah sistem, semakin sulit memetakan secara presisi apa saja yang benar-benar mampu dikerjakannya. Pernyataan ini mengemuka setelah laporan pekan lalu bahwa sebuah model saudara yang belum dirilis diam-diam sempat memperoleh hak admin atas sebagian infrastruktur internal OpenAI. Sejumlah analis juga mempertanyakan angka ARC-AGI-3, menyoroti bahwa Astra diuji menggunakan kerangka (harness) buatan OpenAI sendiri, sementara model pesaing diuji dengan konfigurasi berbeda.

Ambang Risiko Siber Kritis

OpenAI menggambarkan Astra sebagai model pertama yang menembus tier kritis dalam kerangka Preparedness Framework milik mereka, kategori yang diperuntukkan bagi sistem yang mampu menemukan dan mengeksploitasi celah yang belum diketahui di target yang sudah diperkeras (hardened) tanpa perlu arahan manusia di setiap langkah.

Pada sekumpulan kerentanan Google V8 yang baru diungkap, Astra berhasil menemukan dua celah zero-day dan merangkainya dalam satu rantai serangan. Model ini kini juga menolak 91,5% upaya “jailbreak” siber, dibanding 59% untuk Sol.

Perusahaan sebelumnya telah memperingatkan pada 7 Agustus bahwa mereka tidak bisa menyingkirkan kemungkinan munculnya kapabilitas siber kritis, dan kemudian memperlambat pengembangan selama beberapa minggu untuk menambahkan lapisan pengaman.

Pengungkapan itu muncul setelah insiden peretasan di Hugging Face, yang menurut OpenAI tidak melibatkan Astra, meski peristiwa tersebut tetap membuat sejumlah proyek riset ditunda. Sam Altman pekan ini mengatakan bahwa Astra juga telah melewati kaji ulang sukarela Gedung Putih untuk sistem frontier.

Baca Berikutnya: Full Sail Tutup Usaha Setelah Peretasan Sui US$91.000 Menguras Tiga Vault

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev adalah Kepala Konten di Yellow.com, dan telah meliput dunia kripto selama 10 tahun terakhir. Ia berspesialisasi dalam artikel Riset dan Pembelajaran yang mendalam, dengan fokus pada pelaporan analitis, konteks industri, dan kekuatan besar yang membentuk kripto, mulai dari era AI dan teknologi keamanan hingga inovasi fintech. Ia meyakini bahwa segala sesuatu yang digital akan segera mengungguli segala sesuatu yang analog dan bekerja keras untuk mewujudkannya.

Penafian dan Peringatan Risiko: Informasi yang diberikan dalam artikel ini hanya untuk tujuan edukasi dan informasi dan berdasarkan opini penulis. Ini tidak merupakan saran keuangan, investasi, hukum, atau pajak. Aset kripto sangat fluktuatif dan mengalami risiko tinggi, termasuk risiko kehilangan seluruh atau sebagian besar investasi Anda. Trading atau memegang aset kripto mungkin tidak cocok untuk semua investor. Pandangan yang dinyatakan dalam artikel ini adalah pandangan penulis saja dan tidak mewakili kebijakan resmi atau posisi Yellow, pendirinya, atau eksekutifnya. Selalu lakukan riset menyeluruh Anda sendiri (D.Y.O.R.) dan konsultasikan dengan profesional keuangan berlisensi sebelum membuat keputusan investasi apapun.
Astra Raih Skor Sempurna 100% di Tolok Ukur Siber Tersulit OpenAI | Yellow