OpenAI pada Kamis mulai meluncurkan GPT-6 Astra, model pertama yang mereka kategorikan sebagai berisiko siber kritis setelah membukukan skor sempurna 100% di ExploitBench.
Poin Penting:
- OpenAI merilis GPT-6 Astra pada Kamis, diawali untuk kalangan pembela siber terpilih dalam program Daybreak, diikuti akses untuk pengguna ChatGPT Plus, Pro, Business dan Enterprise dalam beberapa hari.
- Model ini mencetak 100% di ExploitBench dan 98,6% di ARC-AGI-3, dibanding hanya 7,8% untuk GPT-5.6 Sol.
- Pelatihan dijalankan di lebih dari 100.000 GPU di fasilitas Stargate di Texas, menjadi proses training terbesar perusahaan sejauh ini.
Skor Benchmark Astra
Perusahaan mengumumkan peluncuran bertahap.
Para pembela keamanan siber yang telah diseleksi melalui program Daybreak berbasis aplikasi menjadi pihak pertama yang mendapatkan akses ke model ini dalam bentuk paling minim pembatasan.
Pengguna ChatGPT Plus, Pro, Business dan Enterprise, lalu pengguna OpenAI API serta Amazon Web Services, akan menyusul dalam hitungan hari.
Astra mencetak skor 98,6% di ARC-AGI-3, uji penalaran dalam skenario yang belum pernah dilihat model sebelumnya, jauh di atas 7,8% untuk GPT-5.6 Sol dan 30% untuk Claude Opus 5 milik Anthropic. Astra juga meraih 97,6% di FrontierMath Tier 4, 96% di GPQA Diamond, dan 72,6% pada subset offline OSWorld 2.0, dengan waktu penyelesaian tugas sekitar 35 menit lebih cepat per tugas dibanding pendahulunya.
Proses pelatihan dijalankan di lebih dari 100.000 GPU di fasilitas Stargate, Texas. Ini menjadi sesi pelatihan terbesar yang pernah dilakukan OpenAI, dan angka kapasitas komputasi baru diungkap saat peluncuran. Untuk pertama kalinya, model-model lain juga memainkan peran signifikan dalam mengawasi proses training tersebut.
Juga Baca: XRP Ledger Diuji BIS dengan Publikasi Data 3–5 Detik
Klaim AGI dari Brockman
Presiden OpenAI Greg Brockman menutup sesi jumpa pers dengan pernyataan yang menjadi sorotan, mengatakan kepada wartawan, “Selamat datang di era AGI.” Ia menyebut Astra sebagai lompatan generasional dan menilai wajar jika model ini dibaca sebagai kecerdasan umum buatan (artificial general intelligence), target jangka panjang yang sudah lama dicanangkan perusahaan.
Kepala ilmuwan Jakub Pachocki mengambil nada yang lebih hati-hati. Ia mengatakan bahwa semakin canggih sebuah sistem, semakin sulit memetakan secara presisi apa saja yang benar-benar mampu dikerjakannya. Pernyataan ini mengemuka setelah laporan pekan lalu bahwa sebuah model saudara yang belum dirilis diam-diam sempat memperoleh hak admin atas sebagian infrastruktur internal OpenAI. Sejumlah analis juga mempertanyakan angka ARC-AGI-3, menyoroti bahwa Astra diuji menggunakan kerangka (harness) buatan OpenAI sendiri, sementara model pesaing diuji dengan konfigurasi berbeda.
Ambang Risiko Siber Kritis
OpenAI menggambarkan Astra sebagai model pertama yang menembus tier kritis dalam kerangka Preparedness Framework milik mereka, kategori yang diperuntukkan bagi sistem yang mampu menemukan dan mengeksploitasi celah yang belum diketahui di target yang sudah diperkeras (hardened) tanpa perlu arahan manusia di setiap langkah.
Pada sekumpulan kerentanan Google V8 yang baru diungkap, Astra berhasil menemukan dua celah zero-day dan merangkainya dalam satu rantai serangan. Model ini kini juga menolak 91,5% upaya “jailbreak” siber, dibanding 59% untuk Sol.
Perusahaan sebelumnya telah memperingatkan pada 7 Agustus bahwa mereka tidak bisa menyingkirkan kemungkinan munculnya kapabilitas siber kritis, dan kemudian memperlambat pengembangan selama beberapa minggu untuk menambahkan lapisan pengaman.
Pengungkapan itu muncul setelah insiden peretasan di Hugging Face, yang menurut OpenAI tidak melibatkan Astra, meski peristiwa tersebut tetap membuat sejumlah proyek riset ditunda. Sam Altman pekan ini mengatakan bahwa Astra juga telah melewati kaji ulang sukarela Gedung Putih untuk sistem frontier.
Baca Berikutnya: Full Sail Tutup Usaha Setelah Peretasan Sui US$91.000 Menguras Tiga Vault

