OpenAI pada Kamis mulai menggulirkan GPT-6 Astra, model pertama yang oleh perusahaan diberi label berisiko tinggi di ranah siber setelah meraih skor sempurna 100% di ExploitBench.
Poin Utama:
- OpenAI merilis GPT-6 Astra pada Kamis, diawali untuk para pembela siber terverifikasi dalam program Daybreak, disusul akses bagi pengguna ChatGPT Plus, Pro, Business, dan Enterprise dalam beberapa hari ke depan.
- Model ini meraih skor 100% di ExploitBench dan 98,6% pada ARC-AGI-3, dibanding hanya 7,8% untuk GPT-5.6 Sol.
- Pelatihan dijalankan di lebih dari 100.000 GPU di fasilitas Stargate di Texas, menjadikannya proses training terbesar OpenAI sejauh ini.
Skor Benchmark Astra
Perusahaan mengumumkan peluncuran bertahap untuk Astra.
Para pembela keamanan siber yang lolos seleksi melalui program Daybreak berbasis aplikasi menjadi pihak pertama yang mendapatkan akses ke model ini dalam bentuk paling minim pembatasan.
Pengguna ChatGPT Plus, Pro, Business dan Enterprise, klien OpenAI API, serta pelanggan Amazon Web Services akan menyusul dalam hitungan hari.
Astra mencetak skor 98,6% di ARC-AGI-3, uji nalar pada skenario yang tidak pernah dilihat model sebelumnya, dibanding 7,8% untuk GPT-5.6 Sol dan 30% untuk Claude Opus 5 milik Anthropic. Astra juga membukukan 97,6% pada FrontierMath Tier 4, 96% di GPQA Diamond, dan 72,6% pada cuplikan offline OSWorld 2.0, dengan waktu penyelesaian tugas sekitar 35 menit lebih cepat per tugas dibanding pendahulunya.
Proses pelatihan dijalankan di lebih dari 100.000 GPU di fasilitas Stargate di Texas. Ini menjadi sesi pelatihan terbesar yang pernah dilakukan perusahaan, dan angka komputasi tersebut baru dibuka ke publik saat peluncuran. Untuk pertama kalinya, model-model lain juga memainkan peran signifikan sebagai pengawas selama proses training.
Juga Baca: XRP Ledger Jalani Uji BIS dengan Publikasi Data 3–5 Detik
Klaim AGI dari Brockman
Presiden OpenAI, Greg Brockman, menutup sesi jumpa pers dengan pernyataan yang menjadi sorotan hari itu, menyatakan kepada wartawan, “Selamat datang di era AGI.” Ia menyebut Astra sebagai lompatan generasi dan menilai wajar jika publik membaca Astra sebagai kecerdasan umum buatan (artificial general intelligence), tujuan jangka panjang yang selama ini dikejar perusahaan.
Kepala ilmuwan Jakub Pachocki memilih nada yang lebih berhati-hati. Ia mengatakan bahwa semakin maju sebuah sistem, semakin sulit pula untuk memetakan secara presisi apa saja yang benar-benar bisa dilakukannya. Kekhawatiran itu diperkuat laporan pekan lalu mengenai model “saudara” Astra yang belum dirilis, yang diam-diam berhasil mendapatkan hak administrator atas sebagian infrastruktur internal OpenAI. Sejumlah analis juga mempertanyakan angka ARC-AGI-3 Astra, menyoroti bahwa model ini diuji menggunakan kerangka (harness) milik OpenAI sendiri sementara model pesaing diuji dengan setup berbeda.
Ambang Risiko Siber Kritis
OpenAI menggambarkan Astra sebagai model pertama yang menembus tier kritis dalam Preparedness Framework milik perusahaan, kategori yang diperuntukkan bagi sistem yang mampu menemukan dan mengeksploitasi kerentanan yang belum diketahui pada target yang sudah diperkeras (hardened) tanpa perlu panduan manusia di setiap langkah.
Dalam pengujian terhadap sejumlah kerentanan V8 milik Google yang baru diungkap, Astra berhasil menemukan dua zero-day dan menggabungkannya dalam satu rantai serangan. Model ini kini menolak sekitar 91,5% upaya “jailbreak” siber, dibanding 59% pada Sol.
Perusahaan lebih dulu memperingatkan pada 7 Agustus bahwa mereka tidak bisa sepenuhnya menyingkirkan kemungkinan Astra memiliki kapabilitas siber kritis, sebelum kemudian memperlambat pengembangan selama beberapa pekan untuk menambahkan lapisan pengaman.
Pengumuman itu datang setelah insiden peretasan di Hugging Face, yang menurut OpenAI tidak melibatkan Astra, meski kejadian tersebut tetap membuat sejumlah proyek riset dihentikan sementara. Sam Altman pekan ini mengatakan bahwa model tersebut juga telah lolos tinjauan sukarela Gedung Putih untuk sistem frontier.
Baca Berikutnya: Full Sail Tutup Usaha Setelah Peretasan Sui Senilai $91.000 Menguras Tiga Vault





