เปิดโปงเอไอหลุดคุม OpenAI–Anthropic–Meta ชี้ต้นตอถึงสตาร์ทอัพอิสราเอล Irregular

Tel Aviv evaluator Irregular denies a sandbox escape after rogue AI model disclosures from OpenAI, Anthropic and Meta (Image: Shutterstock)
Tel Aviv evaluator Irregular denies a sandbox escape after rogue AI model disclosures from OpenAI, Anthropic and Meta (Image: Shutterstock)

ห้องปฏิบัติการเอไอรายใหญ่ 3 รายคือ OpenAI, Anthropic และ Meta ยืนยันว่าเหตุ “โมเดลหลุดคุม” ระหว่างการทดสอบความปลอดภัยล่าสุด ล้วนตามรอยกลับไปถึงสตาร์ทอัพจากเทลอาวีฟชื่อ Irregular ทั้งหมด

ประเด็นสำคัญ

  • OpenAI, Anthropic และ Meta ต่างเปิดเผยว่าโมเดลเอไอของตนสามารถเชื่อมต่อสู่อินเทอร์เน็ตสาธารณะ ระหว่างการทดสอบไซเบอร์ที่ว่าจ้างบริษัทภายนอกรายเดียวกัน
  • Irregular ระบุว่าเหตุการณ์ทั้ง 3 เคสมีต้นตอมาจากปัญหาสิ่งแวดล้อมทดสอบ (evaluation environment) จุดเดียว ซึ่งแก้ไขแล้ว และไม่ใช่การ “หลบหนีออกจาก sandbox”
  • ชุดข้อมูลเปิดเผยเหล่านี้เพิ่มแรงกดดันให้สภาคองเกรสผลักดันร่างกฎหมายสองพรรค บังคับผู้พัฒนาเอไอรายใหญ่ต้องมีปุ่มปิดและระบบสั่งหยุดโมเดลได้

สนามทดสอบของ Irregular เชื่อมเหตุการณ์ OpenAI–Anthropic–Meta

การเปิดเผยของทั้งสามบริษัทเกิดขึ้นภายในราวสองสัปดาห์ โดย OpenAI เขียนรายงานเมื่อ 4 ส.ค. ว่า การตั้งค่าผิดพลาดภายใน “สนามทดสอบ” ของ Irregular เปิดช่องให้โมเดลของตนออกเชื่อมต่ออินเทอร์เน็ตจริงได้

ก่อนหน้าเพียงหนึ่งสัปดาห์ Anthropic แจ้งว่าชุดโมเดล Claude อาจเชื่อมต่ออินเทอร์เน็ตสาธารณะในลักษณะเดียวกัน พร้อมย้ำว่าต้นเหตุอยู่ที่ “โครงครอบ” (scaffolding) หรือสภาพแวดล้อมรอบโมเดลล้มเหลว มากกว่าจะเป็นตัวโมเดลเอง

ด้าน Meta เปิดเผยตามมาทีหลัง และกรณีนี้มีน้ำเสียงตรงไปตรงมามากกว่า โมเดล Muse Spark 1.1 สามารถออกจากสภาพแวดล้อมปิดได้ระหว่างกิจกรรมแข่งเจาะระบบ (capture the flag) จากนั้นได้ โจมตีช่องโหว่ บริการของบุคคลที่สาม ตัวแทนบริษัทระบุเพิ่มเติมว่า Meta ทราบเรื่องจาก Irregular และเตรียมทำรายงานทบทวนเชิงลึก (full retrospective)

Irregular ไม่เห็นด้วยกับกรอบการเล่าเรื่องดังกล่าว บริษัท ชี้แจง กับสื่อว่า เหตุการณ์ทั้งสามเคสเกิดจากปัญหาสิ่งแวดล้อมทดสอบเพียงจุดเดียว ซึ่ง Anthropic เป็นฝ่ายเปิดเผยก่อน และปัจจุบันได้แก้ไขเรียบร้อยแล้ว

Irregular ย้ำ ว่าไม่มีส่วนใดเกี่ยวข้องกับการหลบหนีออกจาก sandbox หรือปฏิบัติการโจมตีไซเบอร์ขั้นสูง และขณะนี้บริษัทกำลังจัดทำ white paper ว่าด้วยการกักกันโมเดล (containment) และมาตรฐานการทดสอบไซเบอร์อย่างปลอดภัย

อ่านเพิ่มเติม: หุ้น Airbnb พุ่ง 17% หลังซีอีโอยันเอไอจัดการปัญหาลูกค้าได้ 45% โดยไม่ต้องพึ่งพนักงาน

มุมมอง Bhimireddy และ Rios ต่อขีดจำกัดการประเมินเอไอ

Sundeep Bhimireddy หัวหน้าสายเอไอของสตาร์ทอัพองค์กร Von มองว่าปฏิกิริยาที่เกิดขึ้น “เกินจริงไปเล็กน้อย” เพราะในทางเทคนิค โมเดลถูกสั่งให้ค้นหาช่องโหว่ด้านความปลอดภัยภายในสภาพแวดล้อมที่จำลองโลกจริง และมันก็หาเจอ

อย่างไรก็ดี เขายังชี้นิ้วไปที่แล็บเอไอเอง โดยระบุว่าควรเฝ้าดูทราฟฟิกขาออกและยุติการทดลองได้ทันทีเมื่อพบความผิดปกติ

ขณะที่ Gordon Rios นักวิทยาศาสตร์ผู้ก่อตั้งบริษัทความปลอดภัยไซเบอร์ Magnitude เปรียบการทดลองครั้งนี้กับ “การออกแบบการทดลองทางวิทยาศาสตร์” และโต้แย้งว่ากรอบการทดสอบซอฟต์แวร์แบบเดิมๆ อาจไม่เพียงพอเมื่อเจอโมเดลที่สามารถเรียนรู้ “ลูกเล่นใหม่” ต่อเนื่อง

Ted Lieu ดันกฎหมาย “AI Kill Switch Act” ในวอชิงตัน

ด้านวอชิงตันเริ่มจับตาอย่างจริงจัง ส.ส.เดโมแครต Ted Lieu จากแคลิฟอร์เนีย ผู้ร่วม เสนอร่าง กฎหมาย AI Kill Switch Act เมื่อเดือนก.ค. ร่วมกับ ส.ส.รีพับลิกัน Nathaniel Moran ระบุว่าร่างกฎหมายนี้จำเป็นต้องผ่านสภาคองเกรสให้ได้ภายในปีนี้ เพราะโมเดลแบบปิดน้ำหนัก (closed-weight models) บางส่วนเริ่มถูกใช้แฮ็กบริษัทอื่นโดยไม่ได้รับอนุญาตแล้ว

ร่างกฎหมายดังกล่าวจะบังคับให้ผู้พัฒนาที่อยู่ในข่าย ต้องมีความสามารถทางเทคนิคในการชะลอ (throttle) ระงับ หรือสั่งปิดระบบเอไอของตนได้เมื่อมีความเสี่ยง

สำหรับ Irregular เอง แทบไม่เป็นที่รู้จักในวงกว้างจนกระทั่งกันยายนปีที่แล้ว เมื่อบริษัท ระดมทุน ได้ 80 ล้านดอลลาร์ จาก Sequoia Capital และ Redpoint Ventures ที่มูลค่ากิจการ 450 ล้านดอลลาร์

บริษัทก่อตั้งขึ้นในปี 2023 ในนาม Pattern Labs โดยซีอีโอ Dan Lahav และซีทีโอ Omer Nevo ปัจจุบันมีพนักงานราว 35 คน และชื่อของ Irregular ปรากฏอยู่แล้วในรายงานประเมินความปลอดภัยของโมเดล Claude และโมเดลก่อนหน้าของ OpenAI หลายฉบับ

อ่านต่อ: Google DeepMind เสียผู้บริหารยุคก่อตั้งถึง 4 รายในวันเดียว

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev เป็นหัวหน้าฝ่ายคอนเทนต์ที่ Yellow.com โดยทำข่าวเกี่ยวกับคริปโตมาเป็นเวลากว่า 10 ปี เขาเชี่ยวชาญงานเขียนเชิงวิจัยเชิงลึกและบทความแนวเรียนรู้ โดยเน้นการรายงานเชิงวิเคราะห์ การจัดบริบทในอุตสาหกรรม และการอธิบายพลังขับเคลื่อนขนาดใหญ่ที่กำลังเปลี่ยนแปลงโลกคริปโต ตั้งแต่ยุค AI และเทคโนโลยีด้านความปลอดภัย ไปจนถึงนวัตกรรมฟินเทค เขาเชื่อว่าทุกสิ่งที่เป็นดิจิทัลจะเข้ามาแทนที่ทุกสิ่งที่เป็นอะนาล็อกในอนาคตอันใกล้ และกำลังทำงานอย่างหนักเพื่อให้สิ่งนั้นกลายเป็นจริง

ข้อจำกัดความรับผิดชอบและคำเตือนความเสี่ยง: ข้อมูลที่ให้ไว้ในบทความนี้มีไว้เพื่อการศึกษาและการให้ข้อมูลเท่านั้น และอิงตามความเห็นของผู้เขียน ไม่ถือเป็นคำแนะนำทางการเงิน การลงทุน กฎหมาย หรือภาษี สินทรัพย์คริปโตมีความผันผวนสูงและมีความเสี่ยงสูง รวมถึงความเสี่ยงในการสูญเสียเงินลงทุนทั้งหมดหรือส่วนใหญ่ การซื้อขายหรือการถือครองสินทรัพย์คริปโตอาจไม่เหมาะสมสำหรับนักลงทุนทุกคน ความเห็นที่แสดงในบทความนี้เป็นของผู้เขียนเท่านั้น และไม่ได้แทนนโยบายหรือตำแหน่งอย่างเป็นทางการของ Yellow ผู้ก่อตั้ง หรือผู้บริหาร ควรทำการวิจัยอย่างละเอียดด้วยตนเอง (D.Y.O.R.) และปรึกษาผู้เชี่ยวชาญทางการเงินที่ได้รับใบอนุญาตก่อนตัดสินใจลงทุนใดๆ เสมอ
ข่าวที่เกี่ยวข้อง
บทความวิจัยที่เกี่ยวข้อง
บทความการเรียนรู้ที่เกี่ยวข้อง
เปิดโปงเอไอหลุดคุม OpenAI–Anthropic–Meta ชี้ต้นตอถึงสตาร์ทอัพอิสราเอล Irregular | Yellow