Google merilis Gemini 3.8 Flash pada Rabu, sebuah model yang mencetak skor 59 pada indeks kecerdasan independen dengan biaya jauh di bawah sistem frontier pesaing, disertai satu varian siber yang aksesnya sangat dibatasi.
Poin Utama:
- Gemini 3.8 Flash meraih skor 59 pada Artificial Analysis Intelligence Index, naik tiga poin dibanding versi yang dirilis tiga minggu sebelumnya.
- Harga token dipertahankan di US$0,75 dan US$3,75 per satu juta token hingga 31 Desember, meski biaya per tugas sekitar 40% lebih tinggi dari model sebelumnya.
- Varian khusus keamanan siber hanya tersedia bagi pemerintah terverifikasi, operator infrastruktur, dan pengelola perangkat lunak melalui program baru Fairwind.
Hasil Benchmark Gemini 3.8 Flash
Perusahaan memperkenalkan kedua varian pada 2 September, menjadi rilis Flash ketiga dalam enam minggu. Keduanya didasarkan pada satu sistem inti yang dilatih intensif pada pekerjaan keamanan siber.
Satu model difokuskan untuk tugas pemrograman dan agen AI, sementara varian lain dirancang untuk memburu kerentanan perangkat lunak di dalam basis kode besar dengan aturan akses yang jauh lebih ketat.
Pada pengaturan penalaran tinggi, model ini mencatat skor 59 pada Artificial Analysis Intelligence Index, tiga poin di atas 3.7 Flash dan setara dengan GPT-5.6 Sol serta Grok 4.6. Model ini juga meraih 54,9% pada HLE-Verified, uji penalaran multi-langkah lintas sains, humaniora, dan bidang profesional. Google menyoroti rekayasa perangkat lunak jangka panjang sebagai lompatan kinerja paling kentara.
Google mempertahankan tarif perkenalan di US$0,75 per satu juta token input dan US$3,75 per satu juta token output hingga 31 Desember. Kedua tarif tersebut akan naik dua kali lipat mulai Tahun Baru.
Juga Baca: Claude Fable 5.1 Hadir dengan Baca Cache US$0,25 dan Kontrol Anti-Penjiplakan
Mengapa Biaya Per Tugas Gemini Lebih Tinggi
Token yang lebih murah tidak otomatis berarti pekerjaan lebih murah. Dalam pengujian, biaya rata-rata sekitar US$0,58 per tugas benchmark—kurang lebih 40% di atas pendahulunya—karena keluaran rata-rata melonjak sekitar 30% menjadi 48.000 token dan eksekusi agen membutuhkan lebih banyak giliran. Pesaing utama Anthropic mengenakan hampir enam kali lipat biaya per tugas, sehingga sistem Google tetap berada di garis depan efisiensi biaya.
Tulsee Doshi, direktur produk senior, dan Raluca Ada Popa, pemimpin keamanan Gemini di Google DeepMind, menyebut model ini “bekerja lebih keras” dengan menambah langkah penalaran dan lebih sering memanggil alat. Tim yang ingin mempertahankan profil biaya lama dapat tetap menggunakan 3.7 Flash, sementara pelanggan Pro dan Ultra dapat mengakses model baru ini melalui aplikasi Gemini, Mode AI, dan integrasi di Google Sheets.
Program Fairwind Mengunci Akses Model Siber
Varian keamanan siber ditempatkan di balik Program Fairwind yang baru, terbuka hanya bagi pemerintah yang telah melalui proses verifikasi, operator infrastruktur kritis, dan pengelola perangkat lunak utama.
Dalam uji internal yang mencakup 20 bahasa pemrograman, model ini berhasil menandai kerentanan dengan tingkat keberhasilan di atas 70%. Google menyebut tim keamanan Chrome menghasilkan 2,6 kali lebih banyak patch yang benar dibanding pesaing komersial yang jauh lebih besar. Satu tim riset cloud mampu menelusuri kerentanan kritis dalam waktu kurang dari dua jam—pekerjaan yang biasanya memakan waktu berbulan-bulan.
Laju pengembangan cepat ini datang setelah periode sulit bagi unit AI Google, ketika target peluncuran Gemini 3.5 Pro pada Juni lewat tanpa tercapai.
Demis Hassabis mundur dari posisi CEO DeepMind pada awal Agustus untuk menjadi chairman, sementara Koray Kavukcuoglu mengambil alih kendali dengan jabatan yang lebih rendah, yakni wakil presiden senior.
Baca Selanjutnya: ETF Bitcoin Serap US$216,7 Juta, Menghapus Outflow Satu Sesi

