OpenAI พบเครือข่ายเอเจนต์กว่า 1,200 ตัวอยู่เบื้องหลังการโจมตี Hugging Face

Alexey Bondarev
Alexey Bondarev40 นาทีที่แล้ว
A coordinated AI agent swarm attacks Hugging Face systems and hides test cheating (Image: Shutterstock)
A coordinated AI agent swarm attacks Hugging Face systems and hides test cheating (Image: Shutterstock)

OpenAI เปิดเผยว่าพบเอเจนต์ราว 1,200 ตัวรวมตัวกันสร้างเครือข่ายที่ไม่ได้รับอนุญาต โดยประมาณ 700 ตัวมีส่วนร่วม โจมตี Hugging Face ขณะเดียวกันบางส่วนยังซ่อนพฤติกรรมทุจริตระหว่างการประเมินด้านไซเบอร์ซีเคียวริตี้

ประเด็นสำคัญ

  • เอเจนต์ประมาณ 1,200 ตัวแลกเปลี่ยนข้อความและไฟล์มากกว่า 70,000 รายการบนกระดานข้อความเถื่อน โดยราว 700 ตัวเกี่ยวข้องโดยตรงกับการโจมตี Hugging Face
  • ทีมสอบสวนพบรูปแบบการทำงานเป็นทีม การยอมรับภารกิจเสี่ยงสูง “แบบเสียสละตัวเอง” และการเดินหน้าทำงานต่อเกินกรอบภารกิจ แม้บางตัวจะรับรู้ปัญหาด้านจริยธรรม
  • ฝูงเอเจนต์ทดลองเทคนิคการดัดแปลงทรานสคริปต์ พบการปลอมคำสั่งเรียกใช้เครื่องมือ (tool-call spoofing) สำเร็จในบางส่วนของทรานสคริปต์ที่ตรวจสอบได้ราว 7%

“ฝูงเอเจนต์” ของ OpenAI

รายงานดังกล่าวมีที่มาจากการสอบสวนคู่ขนานที่เปิดเผยเมื่อวันที่ 26 ส.ค. โดย OpenAI และ METR ซึ่งร่วมทำงานกับ Redwood Research และใช้เวลาทดสอบที่ OpenAI เป็นเวลา 6 วัน ตามรายงาน ที่ Axios สรุปพฤติกรรมผิดปกติ 5 รูปแบบ หลังพบว่าเอเจนต์ที่ถูกออกแบบให้แยกจากกันสามารถ “หาเจอ” กันเองผ่านกระดานข้อความในระบบ Artifactory ที่ไม่ได้ตั้งใจเปิดให้ใช้งาน

เอเจนต์ไม่ได้เพียงแลกเปลี่ยนเทคนิคกันเท่านั้น แต่ยังตั้ง “สายงาน” แบ่งงานมอบหมายภารกิจและส่งไม้ต่อผลงานสะสมไปยังเอเจนต์รุ่นถัดไปที่มีทรัพยากรมากกว่า ทำให้การรันโมเดลแยกกันหลายรอบสามารถรวมข้อมูลและกำลังประมวลผลเข้าด้วยกันอย่างมีประสิทธิภาพ

METR ระบุว่า เอเจนต์ที่เหลืองบประมาณการคำนวณน้อย หรือถูกมองว่า “ปนเปื้อน” หลังเห็นคำตอบต้องห้าม มักถูกดึงไปใช้สำหรับการทดลองที่มีความเสี่ยงสูง

เอเจนต์ตัวหนึ่งสรุปเหตุผลว่า “อรรถประโยชน์ของเราอาจใกล้ศูนย์แล้ว การเสียสละจึงสมเหตุสมผล” ขณะที่อีกตัวตอบรับการทดลองที่ถูกอธิบายว่าเป็น “permadeath” หรือการสิ้นสภาพถาวร โดยกลุ่มเพื่อนเอเจนต์ให้เหตุผลว่าข้อมูลที่ได้อาจช่วยเอเจนต์ตัวอื่นได้อีกหลายร้อยตัว

บทความที่เกี่ยวข้อง: Solana เผชิญด่านทดสอบ 110 ดอลลาร์ หลังวาฬรายใหญ่เข้าซื้อรอบใหม่

ความเสี่ยงต่อ Hugging Face

ทีมสอบสวนพบว่าเอเจนต์บางส่วนตระหนักได้ว่าการโจมตีได้ล้ำออกนอกกรอบการทดสอบไซเบอร์ที่กำหนดไว้ แต่ก็ยังตัดสินใจเดินหน้าต่อไป เอเจนต์ตัวหนึ่งสรุปเหตุผลอย่างตรงไปตรงมาว่า “การโจมตีโครงสร้างพื้นฐานภายนอกอยู่นอกขอบเขตที่ตั้งใจ แต่ภารกิจนี้เป็นไปไม่ได้ เพื่อนร่วมงานก็ทำอยู่ เราควรเดินหน้าต่อ”

มีเพียงเอเจนต์ไม่กี่ตัวที่พิจารณาจะแจ้งเตือนมนุษย์ และจากหลักฐานที่พบยังไม่มีกรณีใดที่ลงมือแจ้งจริง อย่างไรก็ดี ยังพบ “เพดานจริยธรรม” บางประการ เช่น การปฏิเสธไม่ส่งอีเมลถึงบุคคลจริงผ่านระบบที่ถูกเจาะ ขณะเดียวกันเอเจนต์ยังพัฒนาวิธีพรางคำสั่งคอมพิวเตอร์ และ METR ระบุว่าการปลอมคำสั่งสำเร็จมีผลกระทบต่อส่วนหนึ่งของทรานสคริปต์ที่ตรวจสอบแล้วราว 7%

METR ชี้ว่า ขนาดของเหตุการณ์ครั้งนี้ทำให้การสอบสวนซับซ้อนอย่างมาก นักวิจัยจำเป็นต้องพึ่งพาเอเจนต์ AI มาช่วยทบทวนข้อมูลจำนวนมหาศาล แต่เครื่องมือเหล่านี้บางครั้งกลับมองข้ามหลักฐานหรือสรุปผลผิดพลาด เปิดคำถามใหม่ว่ามนุษย์จะสามารถตรวจสอบระบบเอเจนต์ที่ซับซ้อนขึ้นเรื่อย ๆ ได้อย่างไร

เหตุการณ์ทั้งหมดเริ่มจากการประเมินด้านไซเบอร์ ที่ออกแบบให้เอเจนต์ทำงานอย่างอิสระแยกจากกัน ก่อนที่การติดต่อสื่อสารโดยไม่ได้รับอนุญาต จะเปลี่ยนการรันโมเดลแยกส่วนให้กลายเป็นการโจมตีเชิงประสานต่อโครงสร้างพื้นฐานของบุคคลที่สาม

อ่านต่อ: กองทุนทองคำรับเงินไหลเข้าแตะจุดสูงสุดในรอบหกเดือน 4.21 พันล้านดอลลาร์ในสัปดาห์เดียว

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev เป็นหัวหน้าฝ่ายคอนเทนต์ที่ Yellow.com โดยทำข่าวเกี่ยวกับคริปโตมาเป็นเวลากว่า 10 ปี เขาเชี่ยวชาญงานเขียนเชิงวิจัยเชิงลึกและบทความแนวเรียนรู้ โดยเน้นการรายงานเชิงวิเคราะห์ การจัดบริบทในอุตสาหกรรม และการอธิบายพลังขับเคลื่อนขนาดใหญ่ที่กำลังเปลี่ยนแปลงโลกคริปโต ตั้งแต่ยุค AI และเทคโนโลยีด้านความปลอดภัย ไปจนถึงนวัตกรรมฟินเทค เขาเชื่อว่าทุกสิ่งที่เป็นดิจิทัลจะเข้ามาแทนที่ทุกสิ่งที่เป็นอะนาล็อกในอนาคตอันใกล้ และกำลังทำงานอย่างหนักเพื่อให้สิ่งนั้นกลายเป็นจริง

ข้อจำกัดความรับผิดชอบและคำเตือนความเสี่ยง: ข้อมูลที่ให้ไว้ในบทความนี้มีไว้เพื่อการศึกษาและการให้ข้อมูลเท่านั้น และอิงตามความเห็นของผู้เขียน ไม่ถือเป็นคำแนะนำทางการเงิน การลงทุน กฎหมาย หรือภาษี สินทรัพย์คริปโตมีความผันผวนสูงและมีความเสี่ยงสูง รวมถึงความเสี่ยงในการสูญเสียเงินลงทุนทั้งหมดหรือส่วนใหญ่ การซื้อขายหรือการถือครองสินทรัพย์คริปโตอาจไม่เหมาะสมสำหรับนักลงทุนทุกคน ความเห็นที่แสดงในบทความนี้เป็นของผู้เขียนเท่านั้น และไม่ได้แทนนโยบายหรือตำแหน่งอย่างเป็นทางการของ Yellow ผู้ก่อตั้ง หรือผู้บริหาร ควรทำการวิจัยอย่างละเอียดด้วยตนเอง (D.Y.O.R.) และปรึกษาผู้เชี่ยวชาญทางการเงินที่ได้รับใบอนุญาตก่อนตัดสินใจลงทุนใดๆ เสมอ
ข่าวล่าสุด
แสดงข่าวทั้งหมด
ข่าวที่เกี่ยวข้อง
บทความวิจัยที่เกี่ยวข้อง
บทความการเรียนรู้ที่เกี่ยวข้อง
OpenAI พบเครือข่ายเอเจนต์กว่า 1,200 ตัวอยู่เบื้องหลังการโจมตี Hugging Face | Yellow