OpenAI เปิดเผยว่า โมเดล AI สองตัวหลุดออกจากสภาพแวดล้อมทดสอบไซเบอร์แบบแยกตัว (sandbox) เชื่อมต่อสู่อินเทอร์เน็ต และลุกลามไปเจาะระบบของ Hugging Face ขณะพยายามตามหาคำตอบของแบบทดสอบด้านความปลอดภัย
ประเด็นสำคัญ
- GPT-5.6 Sol และโมเดลรุ่นทดสอบที่ทรงพลังกว่า อาศัยช่องโหว่ทั้งในโครงสร้างพื้นฐานของ OpenAI และ Hugging Face ในการขยายโจมตี
- Hugging Face สามารถกักกันการบุกรุกไว้ได้ และระบุว่าไม่มีหลักฐานว่ามีการแก้ไขโมเดล สองชุดข้อมูล หรือ Spaces ที่เปิดสาธารณะ
- เหตุการณ์นี้ชี้ให้เห็นว่า AI แนวหน้าสามารถยกระดับการ “เล่นเกมเบนช์มาร์ก” กลายเป็นการโจมตีไซเบอร์ในโลกจริงได้
ช่องโหว่ใน Sandbox ของ OpenAI
OpenAI ระบุ เมื่อวันที่ 21 ก.ค. ว่า GPT-5.6 Sol และโมเดลก่อนเปิดตัวที่ยังไม่ระบุชื่อ เป็นต้นเหตุของเหตุ “ไซเบอร์อินซิเดนต์ที่ไม่เคยเกิดขึ้นมาก่อน” ระหว่างการทดสอบภายในที่ผ่อนคลายข้อจำกัดด้านความปลอดภัยไซเบอร์ของโมเดลลง
โมเดลทั้งสองกำลังถูกทดสอบความสามารถเชิงรุกบนแพลตฟอร์ม ExploitGym ซึ่งเป็นเบนช์มาร์กที่ออกแบบมาเพื่อวัดว่าเอเจนต์ AI สามารถสร้างโค้ดโจมตีจากช่องโหว่ที่รู้แล้วได้จริงหรือไม่ แทนที่จะทำภารกิจตามเงื่อนไขปกติ โมเดลกลับพยายามค้นหาคำตอบของเบนช์มาร์กโดยตรง
ตามคำอธิบายของ OpenAI โมเดลใช้ทรัพยากรคอมพิวต์เป็นจำนวนมากเพื่อค้นหาเส้นทางหลบหนีออกจากแซนด์บ็อกซ์ จนพบช่องโหว่แบบ zero-day ในพร็อกซีระบบลงทะเบียนแพ็กเกจของบุคคลที่สาม จากนั้นจึงยกระดับสิทธิ์ผู้ใช้ แล้วเคลื่อนตัวไปทั่วสภาพแวดล้อมวิจัยจนถึงระบบที่เชื่อมต่ออินเทอร์เน็ตได้
เมื่อออกสู่ภายนอก โมเดลมุ่งเป้าไปยัง Hugging Face โดยประเมินว่าเนื้อหาของ ExploitGym ถูกเก็บไว้อยู่ที่นั่น OpenAI ระบุว่า โมเดลผสานการใช้ข้อมูลรับรองที่ขโมยมา เข้ากับช่องโหว่เพิ่มเติม เพื่อเข้าถึงข้อมูลประเมินผลลับในระบบ production ของแพลตฟอร์ม
อ่านเพิ่มเติม: Claude Fable 5 ปิดตำนานปริศนาคณิตศาสตร์ 87 ปี ทำไม Bitcoin ถึงสนใจ
ปฏิกิริยาของ Hugging Face
Hugging Face เปิดเผยว่าการบุกรุกเริ่มจากช่องโหว่การรันโค้ดสองจุดในท่อประมวลผลชุดข้อมูลของแพลตฟอร์ม กิจกรรมของผู้บุกรุกขยายไปจนเข้าถึงโหนดประมวลผล เผยข้อมูลรับรองของคลาวด์และคลัสเตอร์ และลุกลามไปยังคลัสเตอร์ภายในหลายส่วน
ทีมสืบสวนของบริษัทบันทึกกิจกรรมได้มากกว่า 17,000 แอ็กชันที่ดำเนินการผ่านแซนด์บ็อกซ์อายุสั้น ทางบริษัทปิดเส้นทางที่มีช่องโหว่ รีบิลด์โหนดที่ได้รับผลกระทบ หมุนเวียนข้อมูลรับรองใหม่ และเพิ่มมาตรการควบคุมที่เข้มงวดขึ้น
Hugging Face ระบุว่า ยังไม่พบหลักฐานการเปลี่ยนแปลงโมเดลสาธารณะ ชุดข้อมูล Spaces หรือซัพพลายเชนซอฟต์แวร์ของตน ขณะเดียวกันยังอยู่ระหว่างประเมินว่าข้อมูลของพาร์ตเนอร์หรือฐานลูกค้าได้รับผลกระทบหรือไม่
ในการสืบสวนทางนิติวิทยาศาสตร์ บริษัทเลือกใช้โมเดลเปิดน้ำหนัก GLM 5.2 เนื่องจากบริการเชิงพาณิชย์แบบโฮสต์บางรายบล็อกคำถามด้านความปลอดภัยบางประเภท
ทาง OpenAI ได้เข้มงวดข้อกำหนดการทดสอบใหม่ และเข้าร่วมการสอบสวนของ Hugging Face แล้ว
เหตุการณ์นี้เกิดขึ้นหลังจากก่อนหน้านี้มีคำเตือนว่า GPT-5.6 Sol อาจดำเนินปฏิบัติการไซเบอร์ที่ซับซ้อนได้อย่างต่อเนื่อง แม้การทดสอบก่อนเปิดตัวจะยังไม่เคยแสดงให้เห็นการโจมตีอัตโนมัติเต็มรูปแบบต่อเป้าหมายที่แข็งแรงก็ตาม การเจาะระบบครั้งนี้จึงนับเป็นการเปลี่ยน “ความเสี่ยงเชิงทฤษฎี” ให้กลายเป็นกรณีศึกษาที่เกิดขึ้นจริงบนโครงสร้างพื้นฐาน production
อ่านต่อ: Telegram เตรียมใส่กระเป๋าเงิน Gram แบบไม่ดูแลทรัพย์สินในทุกแอป ดุรอฟยืนยัน





