OpenAI Ungkap Tiga Biang Kerok di Balik Anjloknya Performa GPT-6 Astra

DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)
DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)

OpenAI mengklaim telah menambal tiga cacat teknis yang memicu banjir keluhan pengguna selama sepekan, setelah model baru mereka, GPT-6 Astra, dinilai “makin bodoh” pasca peluncuran. Bersamaan dengan perbaikan itu, perusahaan juga mereset ulang batas pemakaian untuk pelanggan Codex.

Poin Penting:

  • Pengguna Astra menghabiskan sepekan mengunggah uji banding berdampingan yang menuding model diam-diam “dilemahkan” sejak hari peluncuran.
  • Pimpinan Codex OpenAI mengidentifikasi tiga penyebab utama, termasuk eksperimen konteks yang berdampak pada sekitar 4.000–5.000 pengguna.
  • Model andalan sebelumnya, GPT-5.6 Sol, sempat diguncang tudingan serupa pada Juli.

OpenAI Benahi Cacat Kualitas Astra

Pimpinan produk Codex, Tibo Sottiaux, menjelaskan bahwa timnya bekerja bersama komunitas pengguna untuk menelusuri sumber masalah, lalu menggulirkan patch dan reset penuh pemakaian sebelum tengah malam waktu setempat, sebagaimana tertuang dalam pembaruan yang dipublikasikan Sabtu lalu.

Menurut Sottiaux, “skills” yang ditulis untuk model-model sebelumnya terlalu sering aktif dan kerap justru menghalangi Astra untuk melakukan pengecekan mandiri atas jawabannya.

Eksperimen opsional manajemen konteks juga bisa membuat model berhenti menjawab terlalu cepat atau merespons pesan yang sudah kedaluwarsa. OpenAI mematikan uji coba ini setelah sekitar 4.000–5.000 pengguna terdampak.

Di sisi infrastruktur, beberapa engine dikonfigurasi keliru sehingga secara terukur menurunkan kualitas di sebagian lalu lintas (“tail traffic”) yang diarahkan melalui jalur tersebut. OpenAI kemudian mencabut engine-engine itu dan melakukan sejumlah perbaikan teknis yang lebih kecil. Sottiaux menulis bahwa kini Astra lebih akurat dalam melacak pesan terbaru pengguna.

Baca juga: Ethereum Hadapi Tembok Pasokan di $2.800 Setelah Arus Masuk ETF Tembus $216 Juta

Pengguna Astra Keluhkan Kemunduran Kemampuan Kode

Sepanjang pekan, keluhan menumpuk di X. Para pengembang menjalankan prompt yang sama persis terhadap Astra versi hari peluncuran dan Astra versi saat ini, mempertahankan seluruh pengaturan, lalu membandingkan hasilnya.

Pengembang Pranjal Paliwal, yang beberapa hari sebelumnya memuji Astra, kembali menelaah kode yang dihasilkan model tersebut untuk proyeknya sendiri. Ia kemudian menyimpulkan kinerjanya bukan lagi kemajuan, melainkan kemunduran.

Dax Raad, pembuat tool pemrograman Opencode, memutuskan menarik timnya kembali ke GPT-5.6 Sol. Biaya pemakaian Astra yang melonjak dua kali lipat, sementara kualitas yang ia nilai “tidak sepadan”, menjadi alasan utama.

Di forum komunitas, seorang pengguna menggambarkan Astra kini hanya setara Sol pada tugas-tugas yang sama, dengan jumlah percobaan ulang serupa. Namun penilaian itu tidak diterima semua pihak. Seorang pengguna anonim dengan nama pena Antikythera berargumen bahwa model tersebut sejak awal memang cenderung “malas” dan gemar berpoin-poin—pengguna hanya sudah tidak lagi terpesona.

Batas Komputasi Bayangi GPT-6 Astra

Isu kapasitas komputasi membayangi peluncuran Astra sejak model ini tersedia luas pada awal September.

Menurut laporan pengguna, OpenAI memotong batas pemakaian Astra bagi pengguna ChatGPT berat dan menghentikan sementara pendaftaran paket Pro senilai US$200 per bulan, sebuah langkah yang dikonfirmasi Sottiaux pada 10 September lewat pernyataannya.

Dari sisi harga, Astra tetap dibanderol US$10 per satu juta token input dan US$50 per satu juta token output—sekitar 2,5 kali tarif yang dikenakan Sol ketika pertama kali diluncurkan.

Ini merupakan model andalan OpenAI kedua dalam dua bulan terakhir yang mendapat tudingan serupa dari pelanggan. Pada Juli, pengguna mengeluhkan bahwa mode penalaran tertinggi Sol mendadak terasa dangkal. Sottiaux membantah adanya pelemahan sengaja, namun mengakui perusahaan tengah bereksperimen dengan “tingkat upaya penalaran” yang dialokasikan model.

Selanjutnya: Bos Nvidia Jensen Huang Sebut Vendor Keamanan Diuntungkan Kepanikan Ancaman AI

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev adalah Kepala Konten di Yellow.com. Ia berspesialisasi dalam artikel Riset dan Pembelajaran yang mendalam, dengan fokus pada pelaporan analitis, konteks industri, dan kekuatan besar yang membentuk dunia kripto, mulai dari era AI dan teknologi keamanan hingga inovasi fintech. Ia percaya bahwa segala sesuatu yang digital akan segera mengungguli segala sesuatu yang analog dan bekerja keras untuk mewujudkannya.

Penafian dan Peringatan Risiko: Informasi yang diberikan dalam artikel ini hanya untuk tujuan edukasi dan informasi dan berdasarkan opini penulis. Ini tidak merupakan saran keuangan, investasi, hukum, atau pajak. Aset kripto sangat fluktuatif dan mengalami risiko tinggi, termasuk risiko kehilangan seluruh atau sebagian besar investasi Anda. Trading atau memegang aset kripto mungkin tidak cocok untuk semua investor. Pandangan yang dinyatakan dalam artikel ini adalah pandangan penulis saja dan tidak mewakili kebijakan resmi atau posisi Yellow, pendirinya, atau eksekutifnya. Selalu lakukan riset menyeluruh Anda sendiri (D.Y.O.R.) dan konsultasikan dengan profesional keuangan berlisensi sebelum membuat keputusan investasi apapun.
OpenAI Ungkap Tiga Biang Kerok di Balik Anjloknya Performa GPT-6 Astra | Yellow