OpenAI pada Selasa merilis 722 naskah matematika yang dikelompokkan dalam 372 “keluarga hasil” dari sebuah model AI internal yang belum dibuka ke publik, dan kini para matematikawan diminta menilai apakah langkah itu sejalan dengan pedoman rilis riset yang baru.
Poin-Poin Utama:
- OpenAI mengunggah 722 naskah dalam 372 keluarga hasil di GitHub, seluruhnya berasal dari model internal yang belum bisa diakses publik.
- Kelompok penasihat independen berisi matematikawan menegaskan perannya bukan untuk mengesahkan hasil maupun proses riset OpenAI.
- OpenAI mengakui sebagian hasil yang belum menjalani verifikasi komputer formal bisa mengandung kekeliruan.
Rilis Koleksi Matematika OpenAI
Perusahaan tersebut menerbitkan kumpulan naskah ini di repositori publik GitHub, lengkap dengan aturan revisi dan tata cara sitasi setiap makalah. Repositori itu mencantumkan 722 naskah yang terbagi dalam 372 keluarga; satu keluarga menggabungkan hasil utama dengan argumen pendamping, konsekuensi, atau pembuktian alternatif. OpenAI menyebutkan telah mengajukan sekitar 4.000 soal kepada model dan hanya mempertahankan hasil yang dinilai cukup signifikan.
Menurut perusahaan, rata-rata setiap hasil membutuhkan sekitar tiga jam komputasi “pemikiran” ChatGPT Pro. Banyak bukti (proof) juga disertai versi dalam bahasa pemrograman Lean, yang memungkinkan komputer memverifikasi langkah-langkah pembuktian matematika tersebut.
OpenAI menegaskan sebagian hasil yang belum dilengkapi verifikasi Lean atau pemeriksaan formal serupa berpotensi mengandung masalah.
Baca Juga: Lazarus Korea Utara Diduga Gelapkan US$1 Miliar Lewat Pencuci Uang di Tiongkok, Tuduh ZachXBT
Sikap Hati-Hati Kelompok Penasihat
Advisory Group on Mathematics and Artificial Intelligence, kelompok penasihat beranggotakan sembilan matematikawan tanpa bayaran yang bernaung di Institute for Advanced Study, menyatakan bahwa mandat mereka bukan untuk menilai kebenaran hasil riset maupun mengesahkan proses yang ditempuh OpenAI. Mereka menekankan hanya komunitas matematika yang lebih luas yang bisa menakar seberapa jauh OpenAI mematuhi rekomendasi kelompok tersebut.
Rekomendasi yang diterbitkan 29 September itu antara lain meminta laboratorium AI untuk mencantumkan rujukan ke makalah terdahulu, menulis bukti dalam format mirip makalah matematika tradisional, serta mengungkapkan prompt, ringkasan penalaran, dan biaya komputasi. Mereka juga mendorong agar hasil ditempatkan di repositori ilmiah yang tidak dikendalikan laboratorium AI mana pun. OpenAI menyebut masih menjajaki alternatif repositori yang dikelola komunitas selain GitHub dan akan mendanai lokakarya untuk membahas hasil-hasil besar di bidang AI.
Melanie Matchett Wood, profesor matematika di Harvard sekaligus anggota kelompok penasihat, pada September lalu mengungkapkan peringatan bahwa keluaran matematika dari AI “sering kali mengandung plagiarisme” dan umumnya tidak ada manusia yang bersedia memikul tanggung jawab atasnya. Terpisah, juru bicara perusahaan mengakui bahwa banyak hasil baru ini belum sepenuhnya dipahami oleh para matematikawan di internal OpenAI sendiri.
Kontroversi Navier–Stokes OpenAI
Rilis koleksi makalah ini datang setelah sebulan ketegangan antara OpenAI dan komunitas matematika. Pada 8 September, perusahaan mengumumkan apa yang disebutnya sebagai solusi untuk masalah Navier–Stokes, salah satu persoalan Millennium Prize, yang kemudian memicu sengketa klaim kredit dengan matematikawan New York University, Tristan Buckmaster.
Tiga hari setelah pengumuman tersebut, 25 penerima Fields Medal menandatangani pernyataan yang menentang penggunaan persoalan-persoalan terbuka terkenal sebagai tolok ukur (benchmark) AI. Pada 21 September, OpenAI menyatakan modelnya telah menyelesaikan lebih dari 100 masalah lainnya.
Baca Selanjutnya: AMD Menyebut Permintaan AI Begitu Tinggi hingga Akan ‘Secara Signifikan’ Dongkrak Pasokan Chip pada 2027

