OpenAI เตรียมฝังวอเตอร์มาร์กดิจิทัลที่มองไม่เห็นในข้อความที่สร้างโดย ChatGPT และ Codex สำหรับผู้ใช้งานในสหภาพยุโรป แม้ผลทดสอบของบริษัทเองชี้ว่า เมื่อมีการสลับคำราว 10% อัตราการตรวจจับจะลดลงเหลือเพียง 66%
ประเด็นสำคัญ:
- วอเตอร์มาร์กจะทยอยเปิดใช้กับผู้ใช้ ChatGPT และ Codex ที่เข้าเกณฑ์ทุกแพ็กเกจในอียูในช่วงไม่กี่สัปดาห์ข้างหน้า ขณะที่ลูกค้า API ยังต้องเลือกเปิดเอง
- การแทนที่คำ 25% ด้วยคำพ้องความหมายทำให้อัตราตรวจจับลดลงเหลือ 17% ในการทดสอบของบริษัท
- ช่วงเริ่มต้น ระบบตรวจจับจะเปิดให้เฉพาะนักวิจัยและองค์กรผู้เชี่ยวชาญที่ได้รับการอนุมัติเท่านั้น
โรดแมปการใช้วอเตอร์มาร์กของ OpenAI
บริษัทได้ประกาศแผนดังกล่าวเมื่อวันจันทร์ผ่านบล็อกอย่างเป็นทางการ ระบุว่าระบบมาร์กต้นทางข้อความจะทยอยเปิดใช้ให้ผู้ใช้ ChatGPT และ Codex ที่เข้าเกณฑ์ในอียูทุกแพ็กเกจภายในไม่กี่สัปดาห์ข้างหน้า โดยยังไม่ถูกตั้งเป็นค่าเริ่มต้นในระดับทั่วโลก
ด้านนักพัฒนาที่ใช้ API ของบริษัทจากทุกภูมิภาค สามารถเลือกเปิดใช้ฟีเจอร์ดังกล่าวบนโมเดลบางรุ่นได้แล้วตั้งแต่ตอนนี้ แต่ค่าเริ่มต้นจะยังปิดไว้ ความเคลื่อนไหวนี้ถือเป็นการตอบสนองต่อกฎหมาย EU AI Act ซึ่งข้อกำหนดด้านการมาร์กต้นทางเริ่มมีผลใช้เมื่อ 2 สิงหาคม และบังคับให้ผู้ให้บริการต้องทำให้ข้อความที่ปัญญาประดิษฐ์สร้างขึ้นสามารถระบุตัวตนได้โดยเครื่องจักร ผู้ให้บริการที่ดำเนินงานอยู่เดิมมีเวลาถึง 2 ธันวาคมเพื่อให้สอดคล้องกับข้อบังคับ
อ่านเพิ่มเติม: เอเย่นต์ AI ของ Binance สร้างกลยุทธ์จากประโยคธรรมดา เก็บค่าธรรมเนียมเทรด 19.99 USDC
ขีดจำกัดของการตรวจจับด้วย TextGrain
วิธีการใหม่นี้มีชื่อว่า textGrain ไม่ได้ใส่สัญลักษณ์ใด ๆ ลงในข้อความโดยตรง แต่ใช้การ “บิด” รูปแบบการเลือกคำของโมเดลอย่างแนบเนียน เพื่อทิ้งลายเซ็นในเชิงสถิติที่ระบบตรวจจับสามารถอ่านได้ และจะติดตามไปแม้ข้อความถูกคัดลอกต่อ OpenAI ระบุว่า ผลลัพธ์ของ textGrain อยู่ในระดับเทียบเท่าหรือดีกว่าวิธีอื่นที่ทดสอบ รวมถึง SynthID สำหรับข้อความของ Google และมีแผนจะเปิดเทคโนโลยีนี้เป็นโอเพ่นซอร์สในอนาคต
อย่างไรก็ดี การแก้ไขข้อความภายหลังทำให้สัญญาณเหล่านี้อ่อนลงอย่างมีนัยสำคัญ
ในการทดสอบกับข้อความความยาว 400 โทเคน การเปลี่ยนคำราว 10% เป็นคำพ้องความหมายทำให้อัตราการตรวจจับลดลงจากประมาณ 92% เหลือ 66% และเมื่อเปลี่ยนคำถึง 25% อัตราดังกล่าวจะลดฮวบลงเหลือเพียง 17% นอกจากนี้ ข้อความที่สั้นลง คำตอบเชิงคณิตศาสตร์ และข้อความที่ผ่านการแปลภาษายังตรวจจับได้ยากขึ้น โดยในข้อความความยาว 200 โทเคนในหัวข้ออย่างเช่นจิตวิทยา ระบบตรวจจับได้ประมาณ 80% ที่อัตราความผิดพลาดฝั่งบวก (false positive) อยู่ที่ 1%
การเข้าถึงระบบตรวจจับข้อความจาก ChatGPT
ในช่วงเริ่มต้น OpenAI จะจำกัดการใช้งานตัวตรวจจับไว้เฉพาะนักวิจัยและองค์กรผู้เชี่ยวชาญที่ได้รับการอนุมัติ อ้างถึงความเสี่ยงทั้งจากกรณีตรวจไม่พบวอเตอร์มาร์กและการแจ้งเตือนผิดพลาด บริษัทเตือนด้วยว่า การไม่มีวอเตอร์มาร์ก “ไม่ถือเป็นหลักฐานยืนยันว่าข้อความมาจากมนุษย์” และตัวมาร์กเองก็ไม่เก็บหรือเชื่อมโยงข้อมูลระบุตัวตนของผู้ใช้ บัญชี หรือพรอมป์ต์ที่ใช้สร้างข้อความนั้น
มาตรการนี้เกิดขึ้นหลังจาก Anthropic ประกาศเมื่อเดือนสิงหาคมว่าจะใส่วอเตอร์มาร์กในข้อความที่โมเดล Claude สร้างขึ้นทั่วโลก ซึ่งสร้างเสียงวิจารณ์จากผู้ใช้บางส่วน ทั้งที่ OpenAI เคยพัฒนาระบบวอเตอร์มาร์กสำหรับข้อความมาก่อนแล้ว แต่ชะลอการเปิดใช้ ส่วนหนึ่งเพราะกังวลว่าผู้ใช้อาจย้ายไปใช้บริการคู่แข่ง ตามรายงานข่าวในปี 2024 ทั้งสองบริษัท รวมถึง Google, Meta และ Microsoft ต่างให้คำมั่นปฏิบัติตาม “code of practice” ของอียู ว่าด้วยความโปร่งใสของคอนเทนต์ที่สร้างโดย AI
อ่านต่อ: จอร์เจีย เมโลนี เตรียมจดเครื่องหมายการค้าบนเสียงของตัวเอง จะกัน Deepfake AI ได้จริงหรือไม่

