OpenAI akan menyematkan watermark tak kasatmata pada teks keluaran ChatGPT dan Codex di Uni Eropa. Namun, pengujian internal perusahaan menunjukkan bahwa mengganti sekitar 10% kata saja sudah cukup menurunkan tingkat deteksi menjadi 66%.
Poin Penting:
- Watermark akan digulirkan ke pengguna ChatGPT dan Codex yang memenuhi syarat di seluruh paket di UE dalam beberapa minggu ke depan, sementara untuk pelanggan API tetap bersifat opsional.
- Mengganti 25% kata dengan sinonim menurunkan tingkat deteksi hingga tinggal 17% dalam evaluasi internal OpenAI.
- Akses ke alat pendeteksi awalnya dibatasi hanya untuk peneliti terpilih dan organisasi ahli.
Peluncuran Watermark OpenAI
Perusahaan mengumumkan rencana tersebut pada Senin melalui sebuah posting blog, dengan menyatakan bahwa penandaan akan menjangkau pengguna ChatGPT dan Codex yang memenuhi syarat di semua tingkatan langganan di UE dalam beberapa minggu mendatang. Fitur ini tidak langsung menjadi standar global pada tahap awal.
Pengembang yang menggunakan API OpenAI di mana pun di dunia dapat mulai mengaktifkan watermark untuk model-model tertentu sejak sekarang, meski tetap nonaktif secara default. Langkah ini menjadi jawaban atas AI Act UE, yang sejak 2 Agustus mewajibkan penyedia untuk membuat teks yang dihasilkan AI dapat dikenali oleh mesin. Perusahaan yang sudah beroperasi di pasar memiliki waktu hingga 2 Desember untuk mematuhi aturan tersebut.
Juga Baca: Agen AI Binance Susun Strategi dari Kalimat Biasa, Tarik Biaya 19,99 USDC per Transaksi
Batasan Deteksi textGrain
Metode watermark ini, yang disebut textGrain, tidak menambah simbol apa pun yang terlihat, melainkan secara halus mengarahkan pemilihan kata model sehingga meninggalkan pola statistik yang bisa ditangkap detektor dan tetap menempel saat teks disalin. OpenAI menyatakan metode ini menyamai atau melampaui pendekatan lain yang diuji, termasuk SynthID untuk teks milik Google, dan berencana membuka teknologi ini sebagai open source.
Namun, proses penyuntingan teks melemahkan sinyal tersebut.
Dalam evaluasi terhadap cuplikan sepanjang 400 token, penggantian 10% kata dengan sinonim menurunkan tingkat deteksi dari sekitar 92% menjadi 66%. Mengganti 25% kata memotong tingkat deteksi hingga hanya 17%. Teks yang lebih pendek, jawaban matematika, dan teks terjemahan juga lebih sulit dikenali; untuk cuplikan 200 token bertema psikologi, misalnya, detektor hanya mampu menangkap sekitar 80% dengan tingkat positif palsu 1%.
Akses Detektor ChatGPT
Untuk sementara, OpenAI membatasi akses ke detektor watermark hanya kepada peneliti terverifikasi dan organisasi ahli, dengan alasan risiko watermark yang terlewat maupun positif palsu. Perusahaan juga mengingatkan bahwa absennya watermark “tidak membuktikan teks tersebut ditulis manusia”, serta menegaskan watermark tidak memuat identitas pengguna, akun, maupun isi prompt.
Langkah ini mengikuti jejak Anthropic, yang pada Agustus menyatakan akan menerapkan watermark pada teks keluaran Claude secara global, keputusan yang menuai keluhan sebagian pengguna. OpenAI sendiri pernah mengembangkan watermark teks sebelumnya tetapi menahannya, antara lain karena kekhawatiran pengguna akan beralih ke kompetitor, menurut laporan media pada 2024. Baik OpenAI maupun Anthropic, bersama Google, Meta, dan Microsoft, telah berkomitmen pada kode praktik UE terkait transparansi konten yang dihasilkan AI.
Baca Juga: Giorgia Meloni Ingin Merek Dagang untuk Suaranya, Mampukah Menghentikan Deepfake AI?

