นักวิจัยด้านการทหารของจีนถูกพบว่านำเอาต์พุตจากโมเดล OpenAI และ Anthropic ไปฝึกเป็นระบบปัญญาประดิษฐ์ป้องกันประเทศภายในประเทศ จากการทบทวนเอกสารวิชาการและสิทธิบัตรมากกว่า 80 ฉบับ
ประเด็นสำคัญ
- การทบทวนเอกสารจีนกว่า 80 ฉบับพบว่าสถาบันที่เชื่อมโยงกับกองทัพ นำโมเดลชั้นแนวหน้าของสหรัฐมากลั่นเป็นระบบขนาดเล็กในประเทศ
- หน่วยปฏิบัติการสงครามไซเบอร์ของ PLA แห่งหนึ่งป้อนซอร์สโค้ดทางทหารที่อ่อนไหวให้ GPT-3.5 จากนั้นใช้สรุปความที่ได้ไปฝึกโมเดลภายในประเทศ
- Anthropic ย้ำว่าไม่ได้ขายสิทธิ์ใช้งานเชิงพาณิชย์ในจีน และเตือนว่าโมเดลกลั่นอาจสูญเสียกลไกป้องกันความเสี่ยงของต้นฉบับ
กลั่นโมเดลจากงานวิจัยจีนกว่า 80 ฉบับ
การทบทวนเอกสารวิชาการและสิทธิบัตรของจีน ซึ่งจัดทำร่วมกับ Jamestown Foundation ในวอชิงตัน เผยให้เห็น รูปแบบการใช้งานดังกล่าวในหลายสถาบันที่โยงกับกองทัพปลดปล่อยประชาชนจีน (PLA) พร้อมระบุกรณีศึกษาเพิ่มเติมที่เกี่ยวข้องกับกองทัพอีกกว่า 20 กรณี
เอกสารเหล่านี้อธิบายเทคนิค “การกลั่นโมเดล” (model distillation) ซึ่งนำเอาต์พุตจากระบบขนาดใหญ่สมรรถนะสูง มาใช้เป็นข้อมูลฝึกโมเดลขนาดเล็กที่รันได้บนฮาร์ดแวร์จำกัด
หนึ่งในเอกสารจากหน่วย 96941 ของ PLA ซึ่งเป็นหน่วยข่าวกรองและสงครามไซเบอร์ในกรุงปักกิ่ง ระบุ ว่าได้ป้อนซอร์สโค้ดทางทหารที่เป็นความลับให้ GPT-3.5 ของ OpenAI จากนั้นเก็บเฉพาะสรุปความที่โมเดลสร้างขึ้น แล้วนำข้อมูลดังกล่าวไปฝึกโมเดลภายในประเทศ เพื่อให้เครื่องมือที่ได้สามารถทำงานอยู่ภายในเครือข่ายทหารจีนโดยไม่ต้องเชื่อมต่อเซิร์ฟเวอร์ต่างประเทศ
ทำเนียบขาว เพนตากอน กระทรวงการต่างประเทศจีน PLA และ OpenAI ไม่ได้ตอบคำถามสื่อมวลชนเกี่ยวกับประเด็นนี้
อ่านเพิ่ม: โครงสร้างพื้นฐาน AI พลิกธุรกิจปล่อยกู้วันเงินเดือน 1 พันล้านดอลลาร์สู่สนามดาต้าเซ็นเตอร์
มุมมอง Sunny Cheung ว่าด้วย “การขโมยตรรกะ” ของ AI
Sunny Cheung เพื่อนวิจัยของ Jamestown ผู้วิเคราะห์เอกสารมากกว่า 60 ฉบับ ระบุว่านักวิทยาศาสตร์ทหารจีนกำลัง “จับ” ขั้นตอนการให้เหตุผลของระบบตะวันตกอย่างเป็นระบบ
เขาให้สัมภาษณ์ กับสื่อ ว่าผลงานเหล่านี้ถูกนำไปใช้ในระบบเฝ้าระวัง สงครามไซเบอร์ และการตัดสินใจเชิงยุทธวิธี โดยชี้ว่าการสอนโมเดลให้ตอบถูกเป็นเรื่องหนึ่ง แต่อีกระดับที่ยากกว่าคือย้าย “ตรรกะและขั้นตอนคิด” เบื้องหลังคำตอบเข้าไปอยู่ในโมเดลขนาดเล็ก
ทีมนักวิจัยจากมหาวิทยาลัย North University of China ซึ่งถูกมองว่าเกี่ยวข้องกับอุตสาหกรรมอาวุธของจีน ใช้ Claude 3 Haiku ของ Anthropic สร้างข้อมูลฝึกสังเคราะห์ สำหรับระบบติดตามสื่อสังคมออนไลน์ Anthropic ระบุว่าไม่ได้ขายสิทธิ์ใช้งานเชิงพาณิชย์ของ Claude ในจีน พร้อมระบุว่ามีระบบมอนิเตอร์เพื่อตรวจจับการใช้งานผิดนโยบาย และเตือนว่าโมเดลที่ถูกกลั่นเลียนแบบอาจหลุดกลไกป้องกันที่ฝังไว้ในต้นฉบับ
ขีดจำกัดของการกลั่นโมเดล และช่องว่างในกฎควบคุมการส่งออก
Trevor Koverko ผู้ร่วมก่อตั้งบริษัทข้อมูลด้าน AI Sapien ระบุว่าโมเดลที่ผ่านการกลั่นยังมีศักยภาพด้อยกว่าโมเดลต้นทาง เขา มองว่า สิ่งที่เกิดขึ้นคือการถ่ายโอน “ความสามารถบางส่วนที่เลือกแล้ว” ไปสู่ระบบที่มีต้นทุนถูกกว่าและควบคุมได้ในประเทศ มากกว่าจะทำให้จีนหลุดพ้นจากการพึ่งพา AI ชั้นแนวหน้าของสหรัฐ
ขณะเดียวกัน รัฐบาลกลางและท้องถิ่นของจีนอัดงบสนับสนุนงาน “ทำให้โมเดลเบาลง” (model lightweighting) และคอมพิวติ้งที่ปลายทาง (edge computing) โดยชี้เป้าการอุดหนุนไปยังซอฟต์แวร์ที่รันบนโดรน ดาวเทียม และอุปกรณ์ที่มีข้อจำกัดด้านทรัพยากรอื่น ๆ
กระแสกดดันต่อเทคนิคดังกล่าวสุกงอมมาต่อเนื่อง ล่าสุดรัฐมนตรีคลังสหรัฐ Scott Bessent ขู่ใช้มาตรการคว่ำบาตรต่อบริษัทจีนที่กระทรวงตีตราว่ามีส่วนเกี่ยวข้องกับการกลั่นโมเดล สตาร์ทอัป Moonshot เพิ่งออกมาปฏิเสธเมื่อสัปดาห์ที่แล้วว่าโมเดล Kimi K3 ของบริษัทไม่ได้พึ่งพาเทคนิคนี้ ขณะที่ปักกิ่งโต้กลับว่าวอชิงตันกำลังไล่ล่า “ความเป็นเจ้าโลกด้าน AI” และชี้ว่าบริษัทอเมริกันเองก็มีการปฏิบัติในลักษณะคล้ายกัน
อ่านต่อ: ข่าวลือ iPhone พับได้เริ่มชัด ราคา 2,500 ดอลลาร์ ไร้ Face ID และเลนส์เทเลโฟโต






