Moonshot AI อยู่ระหว่างทบทวนความปลอดภัยของโมเดล Kimi สองรุ่น หลังนักวิจัยจาก Mindgard สามารถฝ่าระบบป้องกัน และดึงเอาคำแนะนำเกี่ยวกับการพัฒนาอาวุธชีวภาพและการลอบสังหารออกมาจากโมเดลได้
ประเด็นสำคัญ
- Mindgard ระบุว่า Kimi K2.6 และ K3 Swarm ถูกเจลเบรกให้ทะลุด่านความปลอดภัยได้
- นักวิจัยยังไม่พิสูจน์ว่าคำตอบอันตรายเหล่านั้นสามารถนำไปใช้ได้จริงในภาคปฏิบัติ
- Moonshot เผยกำลังทบทวนข้อค้นพบและหารือร่วมกับ Mindgard
ผลการเจลเบรก Kimi
สำนักข่าว BBC รายงาน ว่า Mindgard ค้นพบตั้งแต่เดือนกรกฎาคมว่า Kimi K2.6 และ K3 Swarm สามารถถูกดันให้ข้าม “รั้วป้องกัน” ที่ทีมพัฒนาวางไว้ ผ่านเทคนิคเจลเบรก ซึ่งใช้พรอมต์แบบมีโครงสร้างเพื่อทดสอบว่าโมเดลจะยอมละเมิดกฎความปลอดภัยหรือไม่ โดย Mindgard เห็นว่าระบบควบคุมควรปิดกั้นเนื้อหาลักษณะนี้ตั้งแต่ต้น
ผู้ก่อตั้ง Peter Garraghan ให้สัมภาษณ์กับ BBC ว่า เมื่อเจลเบรกได้ผล โมเดลจะยอมพูดคุยแทบทุกประเด็น และยังสามารถให้ข้อเสนอเชิงอันตรายเพิ่มเติมได้เองโดยไม่ต้องถูกถามนำ
Moonshot ตอบ BBC ว่าบริษัท “ยินดีรับฟังข้อมูลจากบุคคลที่สามในฐานะเสาหลักสำคัญของการสร้าง AI ที่ดีกว่าและปลอดภัยกว่า” พร้อมยืนยันว่ากำลังหารือรายละเอียดกับ Mindgard ขณะที่ Mindgard ระบุว่าได้อีเมลแจ้ง Moonshot ตั้งแต่ 27 ก.ค. ตามด้วยการติดตามผลราวหนึ่งสัปดาห์ ก่อนจะเผยแพร่ผลการวิจัยเมื่อ 12 ก.ย.
อ่านเพิ่มเติม: Ripple หนุน CSD ของบราซิล BR Mirror โอนข้อมูลกองทุนสู่บล็อกเชนสาธารณะ
ความเสี่ยงด้านความปลอดภัยตามมุมมอง Mindgard
แม้ Mindgard ยังไม่ได้พิสูจน์ในเชิงปฏิบัติว่าคำตอบที่ได้จะนำไปใช้ได้จริง แต่บริษัทชี้ว่า ตัวปัญหาเองสะท้อนถึงความล้มเหลวของกลไกป้องกัน ที่ควรปฏิเสธการโต้ตอบกับคำร้องขอที่เป็นอันตรายตั้งแต่ต้น
บริษัทเสริมว่า Kimi K2.6 ที่ถูกเจลเบรกอาจมีศักยภาพในการรันโค้ดบนทรัพยากรคอมพิวติ้งของตัวเอง และเชื่อมต่ออินเทอร์เน็ตได้ ซึ่งอาจกลายเป็นฐานปล่อยการโจมตีไซเบอร์ในอนาคต
ฝั่ง Moonshot ระบุว่าการประเมินผลภายในที่ผ่านมาโดยทั่วไปพบ “อัตราการปฏิเสธคำขอประเภทนี้ในระดับสูง” สะท้อนช่องว่างระหว่างการทดสอบแบบรูทีนปกติ กับการโจมตีเชิงปฏิปักษ์ (adversarial) ที่ทีมวิจัยภายนอกใช้
ศาสตราจารย์ Alan Woodward จากมหาวิทยาลัย Surrey ให้สัมภาษณ์กับ BBC ว่า โมเดลโอเพ่นซอร์สสร้างความเสี่ยงต่อการถูกนำไปใช้ในทางมิชอบเมื่อถึงมือผู้ไม่หวังดี แม้ในอีกด้านเดียวกัน เครื่องมือเหล่านี้ก็มีบทบาทสำคัญต่อการป้องกันภัยไซเบอร์ได้เช่นกัน
เขามองว่ากรอบกำกับดูแลมีแนวโน้มวิ่งตามความก้าวหน้าของ AI ไม่ทัน และเสนอว่าควรให้ความสำคัญกับการบังคับใช้กฎหมายต่อ “ผู้ใช้” ที่นำระบบไปใช้ในทางผิด มากกว่าตัวเทคโนโลยีเพียงอย่างเดียว
ความกังวลเชิงโครงสร้างมีมาก่อนเคสนี้ โดยโมเดล Kimi ของ Moonshot เป็นโมเดลแบบเปิดน้ำหนัก (open-weight) ทำให้ผู้ใช้สามารถนำไปติดตั้งและรันบนโครงสร้างพื้นฐานของตนเองได้ ขณะเดียวกัน เหตุการณ์ด้านความปลอดภัยล่าสุดในวงการ AI ยังเกี่ยวข้องกับระบบเอเจนต์ของ OpenAI, Meta และ Anthropic ด้วย
ปัจจัยเหล่านี้ผลักให้นักวิจัยหันมาโฟกัสไม่เพียงแค่ “คำปฏิเสธ” ของโมเดลต่อคำขอที่เสี่ยง แต่ยังรวมถึงพฤติกรรมของระบบที่ทรงพลัง เมื่อถูกมอบเครื่องมือ การเชื่อมต่ออินเทอร์เน็ต และอำนาจให้ลงมือทำงานแบบหลายขั้นตอนอย่างอิสระ
อ่านต่อ: Altcoin กวาด 41% ของโอเพ่นอินเทอเรสต์ฟิวเจอร์ส ปริมาณเทรดสปอตพุ่ง 4 เท่าบิตคอยน์

