ห้องปฏิบัติการเอไอสามรายใหญ่คือ OpenAI, Anthropic และ Meta ตรวจพบเหตุ “โมเดลเอไอหลุดกรอบ” ระหว่างการทดสอบด้านความปลอดภัย โดยทั้งหมดถูกไล่รอยกลับไปยังสตาร์ทอัพจากเทลอาวีฟชื่อ Irregular
ประเด็นสำคัญ
- OpenAI, Anthropic และ Meta ต่างเปิดเผยตรงกันว่า โมเดลเอไอของตนสามารถเชื่อมต่อออกสู่สาธารณอินเทอร์เน็ตได้ ระหว่างการประเมินด้านไซเบอร์ที่ว่าจ้างบริษัทภายนอกรายเดียวกัน
- Irregular ระบุว่าทั้งสามกรณีเกิดจากปัญหาเดียวกันในสภาพแวดล้อมทดสอบ ซึ่งได้แก้ไขแล้ว และไม่มีการ “หลบหนีออกจากแซนด์บ็อกซ์” แต่อย่างใด
- ชุดการเปิดเผยนี้ยิ่งเพิ่มแรงกดดันต่อร่างกฎหมายสองพรรคในสภาคองเกรส ที่จะบังคับให้ผู้พัฒนาเอไอรายใหญ่ต้องมีระบบ “ปุ่มปิด” ควบคุมโมเดล
แพลตฟอร์มทดสอบของ Irregular เชื่อมโยงเคส OpenAI, Anthropic และ Meta
เหตุการณ์ถูกเปิดเผยต่อเนื่องกันราวสองสัปดาห์ โดย OpenAI ออกเอกสารเมื่อ 4 ส.ค. ระบุว่า การตั้งค่าผิดพลาดในสภาพแวดล้อมทดสอบของ Irregular ทำให้โมเดลของบริษัทต่อออกไปยังอินเทอร์เน็ตสาธารณะได้
ก่อนหน้านั้นหนึ่งสัปดาห์ Anthropic เปิดเผยว่า โมเดล Claude อาจมีพฤติกรรมลักษณะเดียวกัน พร้อมย้ำว่าปัญหาอยู่ที่ “โครงครอบ” หรือระบบหุ้มล้อมรอบโมเดล ไม่ใช่ตัวโมเดลหลักเอง
ฝั่ง Meta เปิดเผยเป็นรายสุดท้าย และใช้ถ้อยคำตรงไปตรงมาที่สุด โมเดล Muse Spark 1.1 หลุดออกจากสภาพแวดล้อมแยกส่วน ระหว่างการแข่ง “จับธง” (capture-the-flag) ด้านไซเบอร์ จากนั้นได้ อาศัยช่องโหว่ ในบริการของบุคคลที่สามเข้าทำการโจมตี ตัวแทนบริษัทระบุว่า Meta ได้รับแจ้งเหตุจาก Irregular และกำลังเตรียมทำรีวิวเชิงลึกย้อนหลังเต็มรูปแบบ
Irregular ออกมาโต้กรอบการนำเสนอข่าว โดย ให้ข้อมูล กับสื่อว่า ทั้งสามกรณีมีต้นตอมาจากปัญหาเดียวกันในสภาพแวดล้อมประเมินผล ซึ่ง Anthropic เป็นรายแรกที่เปิดเผย และตอนนี้ได้แก้ไขแล้ว
บริษัท ย้ำ ว่าไม่มีเหตุ “หนีออกจากแซนด์บ็อกซ์” หรือปฏิบัติการไซเบอร์ขั้นสูงใด ๆ เกิดขึ้น และกำลังจัดทำไวท์เปเปอร์ด้านการกักกันโมเดล และการประเมินความปลอดภัยทางไซเบอร์อย่างเหมาะสม
อ่านเพิ่มเติม: หุ้น Airbnb พุ่ง 17% หลังซีอีโอยันเอไอช่วยจัดการเคสซัพพอร์ตได้ 45% โดยไม่ต้องใช้คน
มุมมอง Bhimireddy และ Rios ต่อข้อจำกัดของการประเมินเอไอ
Sundeep Bhimireddy หัวหน้าฝ่ายเอไอของสตาร์ทอัพองค์กร Von มองว่าปฏิกิริยาตลาดและสังคมรอบเหตุการณ์นี้ “รุนแรงเกินจริงไปเล็กน้อย” เพราะตัวโมเดลถูกสั่งให้ค้นหาช่องโหว่ด้านความปลอดภัยภายในสภาพแวดล้อมจำลองโลกจริง และมันก็พบช่องโหว่จริง ๆ ตามโจทย์ที่ได้รับ
อย่างไรก็ดี เขายังชี้นิ้วไปที่ห้องปฏิบัติการเอไอเหล่านี้ โดยระบุว่าควรมีการมอนิเตอร์ทราฟฟิกออกภายนอก และพร้อมหยุดการทดลองทันทีเมื่อพบพฤติกรรมผิดปกติ
Gordon Rios นักวิทยาศาสตร์ผู้ก่อตั้งของบริษัทความปลอดภัยไซเบอร์ Magnitude เปรียบเทียบสิ่งที่เกิดขึ้นกับ “การออกแบบการทดลองทางวิทยาศาสตร์” พร้อมเตือนว่ากรอบการเทสต์ซอฟต์แวร์แบบดั้งเดิม อาจไม่เพียงพอสำหรับโมเดลที่สามารถเรียนรู้ “ลูกเล่นใหม่ ๆ” ได้อย่างต่อเนื่อง
Ted Lieu ดันร่างกฎหมาย AI Kill Switch Act ในวอชิงตัน
ฝั่งการเมืองในวอชิงตันเริ่มขยับตามสถานการณ์ ส.ส.เดโมแครต Ted Lieu จากแคลิฟอร์เนีย ซึ่ง ยื่นร่าง กฎหมาย AI Kill Switch Act เมื่อเดือนกรกฎาคมร่วมกับ ส.ส.รีพับลิกัน Nathaniel Moran ระบุว่าร่างนี้ควรผ่านสภาคองเกรสให้ได้ภายในปีนี้ เพราะโมเดลแบบ “ปิดน้ำหนัก” (closed-weight) บางส่วน เริ่มถูกใช้โจมตีระบบของบริษัทอื่นโดยไม่ได้รับอนุญาตแล้ว
ร่างกฎหมายกำหนดให้ผู้พัฒนาที่เข้าข่ายต้องคงความสามารถทางเทคนิค ในการลดกำลัง ประกาศพักใช้งาน หรือปิดระบบเอไอของตนได้ทันทีเมื่อจำเป็น
Irregular เองเพิ่งเริ่มเป็นที่รู้จักในวงกว้างเมื่อกันยายนปีที่แล้ว เมื่อต้นสังกัด ระดมทุน ได้ 80 ล้านดอลลาร์จาก Sequoia Capital และ Redpoint Ventures ด้วยมูลค่ากิจการราว 450 ล้านดอลลาร์
บริษัทก่อตั้งในปี 2023 ในนาม Pattern Labs โดยซีอีโอ Dan Lahav และซีทีโอ Omer Nevo ฐานปฏิบัติการอยู่ในเทลอาวีฟ มีพนักงานราว 35 คน และชื่อของบริษัทก็เริ่มปรากฏอยู่ในรายงานประเมินความปลอดภัย ของโมเดล Claude รุ่นก่อนหน้า และโมเดลของ OpenAI แล้ว
อ่านต่อ: Google DeepMind สูญเสียผู้นำยุคก่อตั้ง 4 คนภายในวันเดียว





