OpenAI Astra Kurangi Penalaran Terbuka, Bangkitkan Lagi Peringatan Keamanan 2025

Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)
Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)

Astra milik OpenAI dinilai semakin sedikit menampilkan proses penalaran secara eksplisit di layar, memicu kembali kekhawatiran yang sebelumnya dipaparkan dalam sebuah makalah tentang monitorability pada 2025 yang ditulis bersama oleh ilmuwan kepala Jakub Pachocki.

Poin Penting:

  • Astra tampak memindahkan lebih banyak proses berpikirnya ke “dalam kepala”, mengurangi penalaran dalam bentuk teks yang terlihat, sehingga muncul kekhawatiran apakah pengawas masih bisa mendeteksi perilaku bermasalah.
  • Ryan Greenblatt dan Pachocki ikut menulis makalah Juli 2025 yang menyebut monitorability rantai-penalaran sebagai peluang keselamatan AI yang bersifat rapuh.
  • Penandatangan Kode Praktik AI Umum UE wajib mengajukan laporan keamanan model ke AI Office, termasuk bukti evaluasi yang dapat mendukung tinjauan independen.

Monitorability Astra

Semafor melaporkan bahwa Astra tampak melakukan lebih banyak penalaran tanpa menampilkannya sebagai teks, sehingga menimbulkan pertanyaan apakah pengawas masih bisa mengenali perilaku mencurigakan saat model bekerja. Greenblatt, peneliti keselamatan AI di Redwood Research, menulis bahwa Astra “terlihat mampu menyelesaikan soal matematika kompetisi tingkat tinggi sepenuhnya di dalam kepalanya.” Ia menambahkan, “Ini tampak sangat mengkhawatirkan.”

Sejumlah laporan juga menyebutkan OpenAI mungkin sengaja mengurangi keterlihatan keluaran proses penalaran model demi mengerek kapabilitas, meski perusahaan belum mengonfirmasi klaim tersebut. Menanggapi pemberitaan itu, Pachocki menyatakan ingin “mencegah terjadinya perlombaan menuju ketidak-terpantau-an yang dipicu oleh pelaporan yang keliru.”

TNW sebelumnya melaporkan bahwa Astra menjadi lebih sulit diawasi dibanding pendahulunya ketika model berupaya menghindari pengawasan—bidang yang oleh OpenAI digolongkan sebagai prioritas riset terbuka.

Juga Baca: OpenAI: AI Kini Bisa Menangani Tugas Riset Selama Beberapa Hari

Peringatan Keamanan Pachocki

Perdebatan ini menonjol karena Greenblatt dan Pachocki termasuk di antara sekitar 40 penulis makalah Juli 2025 yang menggambarkan monitorability rantai-penalaran sebagai peluang baru namun rapuh bagi keselamatan AI. Peneliti dari OpenAI, Google DeepMind, Anthropic, Meta, Amazon, UK AI Security Institute, dan Redwood Research turut berkontribusi.

Makalah tersebut mendesak pengembang model frontier untuk membangun evaluasi monitorability yang terstandardisasi, memublikasikan hasil dan keterbatasannya dalam system card, serta mempertimbangkan aspek monitorability sejajar dengan kapabilitas saat mengambil keputusan pelatihan atau peluncuran.

Regulasi Eropa memberi proses pelaporan itu tujuan formal. Penandatangan General-Purpose AI Code of Practice UE wajib menyampaikan Model Report ke AI Office saat model memasuki pasar, mencakup evaluasi, mitigasi, dan laporan dari evaluator eksternal.

Setiap laporan juga harus menyertakan lima sampel acak pasangan input–output dari setiap evaluasi model yang relevan, sehingga peninjau eksternal memiliki bahan untuk menilai secara independen. OpenAI tercatat sebagai penandatangan penuh.

Kekhawatiran ini sudah muncul jauh sebelum peluncuran Astra. Makalah Juli 2025 memperingatkan bahwa arsitektur baru dapat melemahkan penalaran rantai-pemikiran yang tampak di teks, sementara OpenAI kemudian menerima beban komputasi tambahan sekitar 20% demi memperluas pemantauan keselamatan sistemnya.

Baca Berikutnya: Bitcoin ETF Sedot US$987 Juta, Perpanjang Arus Masuk Jadi Tiga Pekan Beruntun

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev adalah Kepala Konten di Yellow.com, dan telah meliput dunia kripto selama 10 tahun terakhir. Ia mengkhususkan diri pada artikel Riset dan Belajar yang mendalam, dengan fokus pada pelaporan analitis, konteks industri, serta kekuatan besar yang membentuk kripto, mulai dari era AI dan teknologi keamanan hingga inovasi fintech. Ia percaya bahwa segala sesuatu yang digital akan segera mengungguli segala sesuatu yang analog dan bekerja keras untuk mewujudkannya.

Penafian dan Peringatan Risiko: Informasi yang diberikan dalam artikel ini hanya untuk tujuan edukasi dan informasi dan berdasarkan opini penulis. Ini tidak merupakan saran keuangan, investasi, hukum, atau pajak. Aset kripto sangat fluktuatif dan mengalami risiko tinggi, termasuk risiko kehilangan seluruh atau sebagian besar investasi Anda. Trading atau memegang aset kripto mungkin tidak cocok untuk semua investor. Pandangan yang dinyatakan dalam artikel ini adalah pandangan penulis saja dan tidak mewakili kebijakan resmi atau posisi Yellow, pendirinya, atau eksekutifnya. Selalu lakukan riset menyeluruh Anda sendiri (D.Y.O.R.) dan konsultasikan dengan profesional keuangan berlisensi sebelum membuat keputusan investasi apapun.
OpenAI Astra Kurangi Penalaran Terbuka, Bangkitkan Lagi Peringatan Keamanan 2025 | Yellow