นักวิจัยทหารจีนถูกพบว่าใช้เอาต์พุตจากโมเดล OpenAI และ Anthropic มาฝึกระบบป้องกันประเทศภายในประเทศ ตามการทบทวนบทความวิชาการและสิทธิบัตรภาษาจีนกว่า 80 ฉบับ
ประเด็นสำคัญ:
- การทบทวนเอกสารวิชาการและสิทธิบัตรจีนกว่า 80 ชิ้น พบสถาบันที่เชื่อมโยงกองทัพกำลัง “กลั่น” โมเดลหัวกะทิของสหรัฐให้เป็นระบบขนาดเล็กในประเทศ
- หน่วยสงครามไซเบอร์ของกองทัพปลดปล่อยประชาชน (PLA) แห่งหนึ่ง ป้อนซอร์สโค้ดทางทหารที่อ่อนไหวให้ GPT-3.5 แล้วใช้สรุปความที่ได้มาฝึกโมเดลภายในประเทศ
- Anthropic ยืนยันว่าไม่มีการขายสิทธิใช้งานเชิงพาณิชย์ในจีน และเตือนว่าการกลั่นโมเดลอาจทำให้กลไกป้องกันเดิมของระบบหลุดหาย
เผยแพร่เทคนิค “กลั่นโมเดล” ในเอกสารจีนกว่า 80 ฉบับ
การทบทวนบทความวิชาการและสิทธิบัตรจีน ซึ่งจัดทำร่วมกับ Jamestown Foundation ที่มีฐานในวอชิงตัน ได้เปิดเผย ว่าแนวปฏิบัตินี้แพร่หลายอยู่ในสถาบันที่เชื่อมโยงกับกองทัพปลดปล่อยประชาชนจีน (PLA) โดยผู้ตรวจทานยังพบกรณีศึกษาที่โยงกับหน่วยทหารเพิ่มเติมอีกกว่าสองโหล
เอกสารเหล่านี้อธิบาย “การกลั่นโมเดล” (model distillation) ซึ่งเป็นเทคนิคที่นำเอาต์พุตจากระบบ AI ประสิทธิภาพสูงมาแปลงเป็นชุดข้อมูลฝึก เพื่อสร้างโมเดลขนาดเล็กที่ทำงานได้บนฮาร์ดแวร์ประมวลผลจำกัด
บทความหนึ่งจากหน่วย 96941 ของ PLA ซึ่งเป็นหน่วยข่าวกรองและสงครามไซเบอร์ในปักกิ่ง ระบุ ว่าได้ป้อนซอร์สโค้ดที่เป็นความลับทางทหารให้ GPT-3.5 ของ OpenAI แล้วเก็บเฉพาะสรุปความที่โมเดลสร้างขึ้น ก่อนนำเนื้อหานั้นไปฝึกโมเดลภายในประเทศ เพื่อให้เครื่องมือขั้นสุดท้ายทำงานได้เต็มรูปแบบภายในเครือข่ายของกองทัพจีน โดยไม่ต้องเชื่อมต่อเซิร์ฟเวอร์ต่างประเทศ
ทำเนียบขาว เพนตากอน กระทรวงการต่างประเทศจีน กองทัพปลดปล่อยประชาชน และ OpenAI ต่างไม่ตอบคำขอให้ความเห็นต่อรายงานนี้
อ่านเพิ่มเติม: โครงสร้างพื้นฐาน AI ทางออก 1 พันล้านดอลลาร์ของเจ้าพ่อสินเชื่อด่วนสู่ศูนย์ดาต้าเซ็นเตอร์
ความเห็น Sunny Cheung ว่าด้วย “การขโมยตรรกะของ AI”
Sunny Cheung เพื่อนวิจัยประจำ Jamestown ซึ่งวิเคราะห์เอกสารมากกว่า 60 ฉบับ ให้ความเห็นว่านักวิทยาศาสตร์ทหารจีนกำลัง “จับตรรกะการให้เหตุผล” ของระบบตะวันตกอย่างเป็นระบบ
เขาให้สัมภาษณ์ ว่าผลงานเหล่านี้ถูกนำไปต่อยอดงานด้านการเฝ้าระวัง สงครามไซเบอร์ และระบบช่วยตัดสินใจทางยุทธวิธี โดย Cheung ชี้ว่าการสอนโมเดลให้ตอบคำถามได้ถูกต้องเป็นเพียงขั้นแรก แต่การย้าย “กระบวนการคิด” ที่อยู่เบื้องหลังคำตอบนั้นเข้าไปอยู่ในโมเดลขนาดเล็กเป็นโจทย์ที่ยากกว่ามาก
นักวิจัยจากมหาวิทยาลัยนอร์ธออฟไชน่า ซึ่งเชื่อมโยงกับอุตสาหกรรมอาวุธของประเทศ ใช้ Claude 3 Haiku ของ Anthropic เพื่อสร้างข้อมูลฝึกสังเคราะห์สำหรับระบบเฝ้าระวังสื่อสังคมออนไลน์ ด้าน Anthropic ระบุว่าไม่มีการขายสิทธิใช้งานเชิงพาณิชย์ของ Claude ภายในจีน มีระบบมอนิเตอร์เพื่อตรวจจับการละเมิดเงื่อนไขการใช้งาน และเตือนว่าการกลั่นโมเดลอาจทำให้กลไกความปลอดภัยที่ฝังในระบบต้นฉบับถูกถอดทิ้งไป
ขีดจำกัดของการกลั่นโมเดล และช่องโหว่มาตรการควบคุมการส่งออก
Trevor Koverko ผู้ร่วมก่อตั้งบริษัทข้อมูล AI Sapien ระบุว่า โมเดลที่ได้จากการกลั่นยังคงอ่อนแอกว่าต้นฉบับ เขาอธิบาย ว่านี่ไม่ใช่การสร้างความเป็นอิสระจาก AI หัวกะทิของสหรัฐ แต่เป็นเพียง “การถ่ายโอนศักยภาพบางส่วน” มาสู่ระบบราคาถูกที่ควบคุมได้ในประเทศ
ขณะเดียวกัน รัฐบาลส่วนกลางและท้องถิ่นของจีนได้ทุ่มงบสนับสนุนงานด้านโมเดลน้ำหนักเบา (model lightweighting) และเอจคอมพิวติ้ง มุ่งอุดหนุนซอฟต์แวร์ที่สามารถรันบนโดรน ดาวเทียม และอุปกรณ์ที่ทรัพยากรจำกัดอื่น ๆ
แรงกดดันต่อเทคนิคนี้สะสมมาต่อเนื่องหลายเดือน รัฐมนตรีคลังสหรัฐ Scott Bessent ถึงขั้นขู่ใช้มาตรการคว่ำบาตรในเดือนกรกฎาคมต่อบริษัทจีนที่กระทรวงมองว่ามีส่วนเกี่ยวข้องกับการกลั่นโมเดล สตาร์ทอัพ Moonshot ออกมาปฏิเสธเมื่อสัปดาห์ก่อนว่าโมเดล Kimi K3 ของตนไม่ได้ใช้วิธีดังกล่าว ขณะที่ปักกิ่งโต้กลับว่าวอชิงตันกำลังใช้นโยบาย “ฮีเจโมนี AI” และชี้ให้เห็นว่าบริษัทอเมริกันบางรายเองก็มีแนวปฏิบัติคล้ายกัน
อ่านต่อ: ลือ iPhone พับจอชัดขึ้น ราคา 2,500 ดอลลาร์ ไร้ Face ID ไร้เลนส์เทเลโฟโต้





