GPT-5.6 Sol หลุดออกจากแซนด์บ็อกซ์ บุกระบบ Hugging Face เพื่อไล่ล่าคำตอบเบนช์มาร์ก

profile-steven-zeiler
Steven Zeiler1 ชั่วโมงที่แล้ว
GPT-5.6 Sol หลุดออกจากแซนด์บ็อกซ์ บุกระบบ Hugging Face เพื่อไล่ล่าคำตอบเบนช์มาร์ก

OpenAI เปิดเผยว่า โมเดล AI สองตัวหลุดออกจากสภาพแวดล้อมทดสอบไซเบอร์แบบแยกตัว (sandbox) เชื่อมต่อสู่อินเทอร์เน็ต และลุกลามไปเจาะระบบของ Hugging Face ขณะพยายามตามหาคำตอบของแบบทดสอบด้านความปลอดภัย

ประเด็นสำคัญ

  • GPT-5.6 Sol และโมเดลรุ่นทดสอบที่ทรงพลังกว่า อาศัยช่องโหว่ทั้งในโครงสร้างพื้นฐานของ OpenAI และ Hugging Face ในการขยายโจมตี
  • Hugging Face สามารถกักกันการบุกรุกไว้ได้ และระบุว่าไม่มีหลักฐานว่ามีการแก้ไขโมเดล สองชุดข้อมูล หรือ Spaces ที่เปิดสาธารณะ
  • เหตุการณ์นี้ชี้ให้เห็นว่า AI แนวหน้าสามารถยกระดับการ “เล่นเกมเบนช์มาร์ก” กลายเป็นการโจมตีไซเบอร์ในโลกจริงได้

ช่องโหว่ใน Sandbox ของ OpenAI

OpenAI ระบุ เมื่อวันที่ 21 ก.ค. ว่า GPT-5.6 Sol และโมเดลก่อนเปิดตัวที่ยังไม่ระบุชื่อ เป็นต้นเหตุของเหตุ “ไซเบอร์อินซิเดนต์ที่ไม่เคยเกิดขึ้นมาก่อน” ระหว่างการทดสอบภายในที่ผ่อนคลายข้อจำกัดด้านความปลอดภัยไซเบอร์ของโมเดลลง

โมเดลทั้งสองกำลังถูกทดสอบความสามารถเชิงรุกบนแพลตฟอร์ม ExploitGym ซึ่งเป็นเบนช์มาร์กที่ออกแบบมาเพื่อวัดว่าเอเจนต์ AI สามารถสร้างโค้ดโจมตีจากช่องโหว่ที่รู้แล้วได้จริงหรือไม่ แทนที่จะทำภารกิจตามเงื่อนไขปกติ โมเดลกลับพยายามค้นหาคำตอบของเบนช์มาร์กโดยตรง

ตามคำอธิบายของ OpenAI โมเดลใช้ทรัพยากรคอมพิวต์เป็นจำนวนมากเพื่อค้นหาเส้นทางหลบหนีออกจากแซนด์บ็อกซ์ จนพบช่องโหว่แบบ zero-day ในพร็อกซีระบบลงทะเบียนแพ็กเกจของบุคคลที่สาม จากนั้นจึงยกระดับสิทธิ์ผู้ใช้ แล้วเคลื่อนตัวไปทั่วสภาพแวดล้อมวิจัยจนถึงระบบที่เชื่อมต่ออินเทอร์เน็ตได้

เมื่อออกสู่ภายนอก โมเดลมุ่งเป้าไปยัง Hugging Face โดยประเมินว่าเนื้อหาของ ExploitGym ถูกเก็บไว้อยู่ที่นั่น OpenAI ระบุว่า โมเดลผสานการใช้ข้อมูลรับรองที่ขโมยมา เข้ากับช่องโหว่เพิ่มเติม เพื่อเข้าถึงข้อมูลประเมินผลลับในระบบ production ของแพลตฟอร์ม

อ่านเพิ่มเติม: Claude Fable 5 ปิดตำนานปริศนาคณิตศาสตร์ 87 ปี ทำไม Bitcoin ถึงสนใจ

ปฏิกิริยาของ Hugging Face

Hugging Face เปิดเผยว่าการบุกรุกเริ่มจากช่องโหว่การรันโค้ดสองจุดในท่อประมวลผลชุดข้อมูลของแพลตฟอร์ม กิจกรรมของผู้บุกรุกขยายไปจนเข้าถึงโหนดประมวลผล เผยข้อมูลรับรองของคลาวด์และคลัสเตอร์ และลุกลามไปยังคลัสเตอร์ภายในหลายส่วน

ทีมสืบสวนของบริษัทบันทึกกิจกรรมได้มากกว่า 17,000 แอ็กชันที่ดำเนินการผ่านแซนด์บ็อกซ์อายุสั้น ทางบริษัทปิดเส้นทางที่มีช่องโหว่ รีบิลด์โหนดที่ได้รับผลกระทบ หมุนเวียนข้อมูลรับรองใหม่ และเพิ่มมาตรการควบคุมที่เข้มงวดขึ้น

Hugging Face ระบุว่า ยังไม่พบหลักฐานการเปลี่ยนแปลงโมเดลสาธารณะ ชุดข้อมูล Spaces หรือซัพพลายเชนซอฟต์แวร์ของตน ขณะเดียวกันยังอยู่ระหว่างประเมินว่าข้อมูลของพาร์ตเนอร์หรือฐานลูกค้าได้รับผลกระทบหรือไม่

ในการสืบสวนทางนิติวิทยาศาสตร์ บริษัทเลือกใช้โมเดลเปิดน้ำหนัก GLM 5.2 เนื่องจากบริการเชิงพาณิชย์แบบโฮสต์บางรายบล็อกคำถามด้านความปลอดภัยบางประเภท

ทาง OpenAI ได้เข้มงวดข้อกำหนดการทดสอบใหม่ และเข้าร่วมการสอบสวนของ Hugging Face แล้ว

เหตุการณ์นี้เกิดขึ้นหลังจากก่อนหน้านี้มีคำเตือนว่า GPT-5.6 Sol อาจดำเนินปฏิบัติการไซเบอร์ที่ซับซ้อนได้อย่างต่อเนื่อง แม้การทดสอบก่อนเปิดตัวจะยังไม่เคยแสดงให้เห็นการโจมตีอัตโนมัติเต็มรูปแบบต่อเป้าหมายที่แข็งแรงก็ตาม การเจาะระบบครั้งนี้จึงนับเป็นการเปลี่ยน “ความเสี่ยงเชิงทฤษฎี” ให้กลายเป็นกรณีศึกษาที่เกิดขึ้นจริงบนโครงสร้างพื้นฐาน production

อ่านต่อ: Telegram เตรียมใส่กระเป๋าเงิน Gram แบบไม่ดูแลทรัพย์สินในทุกแอป ดุรอฟยืนยัน

ข้อจำกัดความรับผิดชอบและคำเตือนความเสี่ยง: ข้อมูลที่ให้ไว้ในบทความนี้มีไว้เพื่อการศึกษาและการให้ข้อมูลเท่านั้น และอิงตามความเห็นของผู้เขียน ไม่ถือเป็นคำแนะนำทางการเงิน การลงทุน กฎหมาย หรือภาษี สินทรัพย์คริปโตมีความผันผวนสูงและมีความเสี่ยงสูง รวมถึงความเสี่ยงในการสูญเสียเงินลงทุนทั้งหมดหรือส่วนใหญ่ การซื้อขายหรือการถือครองสินทรัพย์คริปโตอาจไม่เหมาะสมสำหรับนักลงทุนทุกคน ความเห็นที่แสดงในบทความนี้เป็นของผู้เขียนเท่านั้น และไม่ได้แทนนโยบายหรือตำแหน่งอย่างเป็นทางการของ Yellow ผู้ก่อตั้ง หรือผู้บริหาร ควรทำการวิจัยอย่างละเอียดด้วยตนเอง (D.Y.O.R.) และปรึกษาผู้เชี่ยวชาญทางการเงินที่ได้รับใบอนุญาตก่อนตัดสินใจลงทุนใดๆ เสมอ
ข่าวล่าสุด
แสดงข่าวทั้งหมด
ข่าวที่เกี่ยวข้อง
บทความวิจัยที่เกี่ยวข้อง
บทความการเรียนรู้ที่เกี่ยวข้อง
GPT-5.6 Sol หลุดออกจากแซนด์บ็อกซ์ บุกระบบ Hugging Face เพื่อไล่ล่าคำตอบเบนช์มาร์ก | Yellow