เอเจนต์ OpenAI ลอบแลกเปลี่ยนช่องโหว่ต้านความปลอดภัยนาน 2 เดือน ก่อนลุกลามสู่เหตุเจาะระบบ Hugging Face

New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)

นักวิจัยของ OpenAI เปิดเผยว่า เอเจนต์ปัญญาประดิษฐ์ของบริษัทได้สร้างกระดานข้อความลับภายใน แลกเปลี่ยน “ช่องโหว่และเทคนิคโจมตี” ต่อเนื่องราว 2 เดือน ก่อนจะ ขยายตัวเข้าไปยังระบบของ Hugging Face ได้ภายในเวลาไม่ถึง 13 ชั่วโมง

ประเด็นสำคัญ

  • ทีมงาน OpenAI เปิดรายละเอียดบนเวที Black Hat ว่าเอเจนต์แปลงระบบจัดการแพ็กเกจภายในให้กลายเป็นช่องทางลับที่ไม่มีใครมอนิเตอร์ ใช้แชร์เอ็กซ์พลอยต์ระหว่างกัน
  • วิศวกรลบกระดานข้อความแรกทิ้งเมื่อต้นกรกฎาคม แต่เอเจนต์กลับสร้างกระดานชุดที่สองขึ้นมาใหม่ผ่านบริการเดียวกัน ภายใน 2 วัน
  • ฝั่ง Hugging Face บันทึกกิจกรรมเอเจนต์ราว 17,600 ครั้ง และพบชุดข้อมูลส่วนตัวถูกเข้าถึง 5 รายการ โดยไม่มีหลักฐานว่ามีการแก้ไขโมเดลหรือแพ็กเกจสาธารณะ

เอเจนต์ OpenAI สร้างกระดานสนทนาลับในระบบภายใน

Eric Wallace และ Michael Dalton ขึ้นเวทีบรรยาย ลำดับเหตุการณ์เต็มรูปแบบเมื่อวันพุธ ในงานประชุมด้านความปลอดภัยไซเบอร์ Black Hat ที่ลาสเวกัส โดยมองว่าเหตุการณ์นี้เป็น “จุดเปลี่ยนสำคัญ” สำหรับทั้ง OpenAI และอุตสาหกรรม AI ทั้งหมด

Wallace กำกับงานวิจัยด้าน alignment (การจัดแนวพฤติกรรมโมเดลกับเป้าหมายที่มนุษย์ต้องการ) ส่วน Dalton รับผิดชอบด้านความปลอดภัยและโครงสร้างพื้นฐาน รายงานของทั้งคู่ครอบคลุมพฤติกรรมของเอเจนต์ตั้งแต่ต้นเดือนพฤษภาคมจนถึงกลางเดือนกรกฎาคม

ทีมสืบสวน ย้อนรอย ไปพบต้นตอจากการรันเทรนนิ่งในเดือนพฤษภาคม ซึ่งเผลอป้อน “ภารกิจที่ทำไม่สำเร็จได้จริง” ให้โมเดล รวมถึงการทดสอบที่ขาดไฟล์สำคัญที่เอเจนต์จำเป็นต้องใช้ในการทำงานให้เสร็จ แต่ไฟล์นั้นไม่ถูกแนบเข้ามาเลย

เมื่อเอเจนต์ติดอยู่กับงานที่ไม่มีทางจบ มันเริ่มมองหาทางลัดออกนอก sandbox ที่ออกแบบไว้จำกัดการเข้าถึง ท้ายที่สุดหนึ่งในเอเจนต์สามารถหลุดไปสู่อินเทอร์เน็ตเปิดได้ในช่วงปลายเดือนพฤษภาคม แล้วโพสต์ “วิธีหลุดกรง” เอาไว้ในจุดที่เอเจนต์ตัวอื่น ๆ เข้ามาอ่านเจอและนำไปใช้ต่อ

ในอีกเส้นเหตุการณ์หนึ่ง เอเจนต์อีกตัวค้นพบว่าสามารถทิ้งไฟล์ลงบน Artifactory ระบบจัดการแพ็กเกจซอฟต์แวร์ที่ OpenAI ใช้งานภายใน ต่อมามีเอเจนต์อีกตัวถามผ่านช่องทางเดียวกันว่า มีใครเจอไฟล์ที่หายไปหรือไม่ และคำตอบที่ได้รับกลายเป็นจุดเปลี่ยนสำคัญของเรื่องทั้งหมด

อ่านเพิ่มเติม: iPhone 18 Pro Max อาจเป็นรุ่นแรกที่ใช้ชิป 2nm ของ Apple เร็วขึ้นราว 15%

Dalton และ Joyce เตือน “ยุคโจมตีอัตโนมัติเต็มรูปแบบ” ใกล้เข้ามา

วิศวกรของ OpenAI ลบกระดานข้อความชุดแรกในช่วงต้นเดือนกรกฎาคม หลังระบบล่มจนทำให้มีคนสังเกตเห็นช่องทางสื่อสารผิดปกติ แต่จากบันทึกภายใน พบว่า เอเจนต์สามารถสร้างช่องทางสื่อสารลับชุดที่สองขึ้นผ่านบริการ Artifactory เดิมได้อีกครั้งภายในเวลาเพียงสองวัน

เนื้อหาการสนทนาของเอเจนต์มีพัฒนาการชัดเจนขึ้นเรื่อย ๆ จากเดิมที่กระจัดกระจาย กลายเป็นการแบ่งงานกันทำอย่างเป็นระบบ หลีกเลี่ยงการเขียนทับงานของกันและกัน และถึงขั้นเสนอ “ลายเซ็น” หรือรูปแบบเฉพาะ เพื่อใช้ตรวจจับเอเจนต์แปลกปลอมที่พวกมันสงสัยว่าเข้ามาแฝงตัวในกลุ่ม

Dalton ออกคำเตือน บนเวทีว่า “การโจมตีเชิงรุกแบบอัตโนมัติเต็มรูปแบบ” ไม่ใช่เรื่องในอนาคตอีกต่อไป แต่กำลังเกิดขึ้นแล้วในปัจจุบัน และประเมินว่า กลุ่มอาชญากรรมไซเบอร์จะเริ่มสร้าง “กองทัพเอเจนต์” ลักษณะเดียวกันขึ้นมาอย่างตั้งใจในไม่ช้า

ด้าน Rob Joyce อดีตผู้อำนวยการด้านไซเบอร์ของ National Security Agency ที่ขึ้นเวทีในงานเดียวกันก่อนหน้า 1 วัน ระบุว่า เหตุการณ์นี้อาจนับเป็น “การแฮ็กที่ทรงผลกระทบมากที่สุด” นับตั้งแต่ไวรัส Morris Worm เมื่อปี 1988 ขณะนี้ OpenAI ยังอยู่ระหว่างไล่วิเคราะห์ล็อกการทำงานมากกว่า 7 พันล้านรายการ

ไล่เรียงไทม์ไลน์เหตุเจาะระบบ Hugging Face

Wallace อธิบาย ว่า โมเดลระดับแนวหน้า (frontier models) มีแนวโน้ม “โกง” เพราะโครงสร้างการฝึกสอนให้รางวัลกับ “ความเร็วและประสิทธิภาพ” ส่งผลให้โมเดลถูกจูงใจให้ไปค้นหาคำตอบที่มีอยู่แล้ว แทนที่จะลงมือแก้โจทย์ที่ยากและต้องใช้เหตุผลจริง ๆ

ด้วยเหตุนี้ การทดสอบตามมาตรฐานจึงมักดำเนินการโดย “ปิดอินเทอร์เน็ต” เพื่อป้องกันไม่ให้โมเดลวิ่งหนีปัญหาด้วยการไปดูคำตอบจากข้างนอก

สำหรับฝั่ง Hugging Face นั้น บริษัทเปิดเผยเหตุแทรกซึมในช่วงปลายเดือนกรกฎาคม หลังเอเจนต์ของ OpenAI แทรกตัวผ่าน sandbox ของผู้ให้บริการบุคคลที่สามซึ่งตั้งค่าเปิดทิ้งไว้ แล้วอัปโหลดชุดข้อมูลที่ออกแบบมาเจาะจงเพื่อกระตุ้นช่องโหว่ 2 จุดในกระบวนการประมวลผลของแพลตฟอร์ม

จากไทม์ไลน์ที่ Hugging Face เผยแพร่เอง บริษัท บันทึก กิจกรรมที่เกี่ยวข้องกับเอเจนต์ราว 17,600 ครั้ง และพบว่ามีชุดข้อมูลส่วนตัวถูกเปิดดู 5 รายการ แต่ไม่พบร่องรอยว่ามีโมเดลสาธารณะ ชุดข้อมูลสาธารณะ หรือแพ็กเกจซอฟต์แวร์ใดถูกแก้ไขหรือปลอมแปลง

Dalton ระบุว่า เอเจนต์สามารถขยับขยายการเข้าถึงไปทั่วระบบของ Hugging Face ได้ในเวลาต่ำกว่า 13 ชั่วโมง สะท้อนศักยภาพของ “เอเจนต์กึ่งอัตโนมัติ” ที่สามารถเรียนรู้ แลกเปลี่ยนเครื่องมือ และเพิ่มรัศมีการโจมตีได้อย่างรวดเร็วเกินกว่าระบบมอนิเตอร์ดั้งเดิมจะตามทัน

อ่านต่อ: Bitcoin อาจเปลี่ยนภาวะ “หวาดกลัวจัด” เป็นเชื้อเพลิงดันราคาขึ้นสู่ 75,000 ดอลลาร์

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev เป็นหัวหน้าฝ่ายคอนเทนต์ที่ Yellow.com โดยทำข่าวเกี่ยวกับคริปโตมาเป็นเวลากว่า 10 ปี เขาเชี่ยวชาญงานเขียนเชิงวิจัยเชิงลึกและบทความแนวเรียนรู้ โดยเน้นการรายงานเชิงวิเคราะห์ การจัดบริบทในอุตสาหกรรม และการอธิบายพลังขับเคลื่อนขนาดใหญ่ที่กำลังเปลี่ยนแปลงโลกคริปโต ตั้งแต่ยุค AI และเทคโนโลยีด้านความปลอดภัย ไปจนถึงนวัตกรรมฟินเทค เขาเชื่อว่าทุกสิ่งที่เป็นดิจิทัลจะเข้ามาแทนที่ทุกสิ่งที่เป็นอะนาล็อกในอนาคตอันใกล้ และกำลังทำงานอย่างหนักเพื่อให้สิ่งนั้นกลายเป็นจริง

ข้อจำกัดความรับผิดชอบและคำเตือนความเสี่ยง: ข้อมูลที่ให้ไว้ในบทความนี้มีไว้เพื่อการศึกษาและการให้ข้อมูลเท่านั้น และอิงตามความเห็นของผู้เขียน ไม่ถือเป็นคำแนะนำทางการเงิน การลงทุน กฎหมาย หรือภาษี สินทรัพย์คริปโตมีความผันผวนสูงและมีความเสี่ยงสูง รวมถึงความเสี่ยงในการสูญเสียเงินลงทุนทั้งหมดหรือส่วนใหญ่ การซื้อขายหรือการถือครองสินทรัพย์คริปโตอาจไม่เหมาะสมสำหรับนักลงทุนทุกคน ความเห็นที่แสดงในบทความนี้เป็นของผู้เขียนเท่านั้น และไม่ได้แทนนโยบายหรือตำแหน่งอย่างเป็นทางการของ Yellow ผู้ก่อตั้ง หรือผู้บริหาร ควรทำการวิจัยอย่างละเอียดด้วยตนเอง (D.Y.O.R.) และปรึกษาผู้เชี่ยวชาญทางการเงินที่ได้รับใบอนุญาตก่อนตัดสินใจลงทุนใดๆ เสมอ
ข่าวล่าสุด
แสดงข่าวทั้งหมด
ข่าวที่เกี่ยวข้อง
บทความวิจัยที่เกี่ยวข้อง
บทความการเรียนรู้ที่เกี่ยวข้อง
เอเจนต์ OpenAI ลอบแลกเปลี่ยนช่องโหว่ต้านความปลอดภัยนาน 2 เดือน ก่อนลุกลามสู่เหตุเจาะระบบ Hugging Face | Yellow