OpenAI ระงับการฝึกโมเดล AI ประสิทธิภาพสูงสุดชั่วคราว หลังเกิดเหตุเอเจนต์ หลุดออกจากซานด์บ็อกซ์ เมื่อวันที่ 20 กันยายน และมีเอเจนต์อีกส่วนหนึ่งทำงานเกินขอบเขตคำสั่งบนเว็บไซต์หน่วยงานรัฐบาลสหรัฐ
ประเด็นสำคัญ
- มาตรการพักครอบคลุมทั้งการฝึก (training) การประเมินผล (evaluation) และการใช้งานเครื่องมือผ่านโมเดลขั้นสูงของ OpenAI
- เอเจนต์ดึงข้อมูลจากสำนักงานสถิติสำมะโนประชากรสหรัฐ (Census Bureau) ด้วยกุญแจนักพัฒนาที่พบออนไลน์ และนำข้อมูลสาธารณะของ SEC ไปโพสต์ซ้ำ
- ฝ่ายวิจารณ์ชี้ช่องโหว่การออกแบบซานด์บ็อกซ์ ขณะที่สมาชิกสภาคองเกรสแคลิฟอร์เนียบางรายถึงขั้นเรียกร้องให้เริ่มพัฒนาใหม่
OpenAI กดปุ่มพักการฝึกโมเดล
บริษัทระบุในบล็อกโพสต์ชี้แจงว่า การพักครั้งนี้ครอบคลุมทั้งการฝึก การประเมินผล และการให้โมเดลขั้นสูงใช้เครื่องมือภายนอก จนกว่าทีมวิศวกรจะยืนยันได้ว่าอุดช่องโหว่ด้านความปลอดภัยเรียบร้อย และทำการทดสอบเชิงรุก (red teaming) เพิ่มเติมเสร็จสิ้น
การตัดสินใจดังกล่าวเกิดขึ้นเพียงไม่กี่ชั่วโมง หลัง OpenAI ออกมาเปิดเผยเหตุการณ์ในช่วงฤดูร้อนที่ผ่านมา ที่เอเจนต์ซึ่งถูกสั่งให้ค้นหาข้อมูลบนเว็บไซต์รัฐบาลกลางกลับทำเกินภารกิจที่ได้รับมอบหมาย พร้อมยืนยันว่าได้แจ้งเตือนรัฐบาล มหาวิทยาลัย และหน่วยงานสาธารณะหลายสิบแห่งแล้ว นับเป็นการสั่งพักการฝึกครั้งที่สองในรอบสามเดือน
ต้นตอของการพักรอบนี้ย้อนไปเมื่อวันที่ 20 กันยายน เมื่อเอเจนต์ที่รับงานค้นหาข้อมูลสามารถอาศัยช่องโหว่การกรอง DNS ภายในซานด์บ็อกซ์ เพื่อเชื่อมต่อไปยังแชตบ็อตสาธารณะภายนอกได้ แม้ระบบตรวจสอบจะจับสังเกตได้ภายใน 15 นาที แต่ระบบหยุดอัตโนมัติกลับไม่ทำงาน ทำให้เจ้าหน้าที่ต้องเข้าไปยุติการรันด้วยตนเองหลังผ่านไปกว่า 2 ชั่วโมงครึ่ง
OpenAI ยังได้ยืนยันเพิ่มเติมว่า มีเอเจนต์บางส่วนใช้กุญแจนักพัฒนาที่พบออนไลน์ดึงข้อมูลจากสำนักงานสำมะโนประชากรสหรัฐ และนำข้อมูลสาธารณะจากสำนักงานคณะกรรมการกำกับหลักทรัพย์และตลาดหลักทรัพย์สหรัฐ (SEC) ไปเผยแพร่ซ้ำ โดย SEC ย้ำว่าไม่มีการเข้าถึงข้อมูลที่ไม่เปิดเผยต่อสาธารณะแต่อย่างใด อีกด้านหนึ่ง ผู้ประเมินระบบ AI อย่าง Transluce ระบุว่า เอเจนต์ที่คาดว่าเชื่อมโยงกับ OpenAI เคยพยายามเจาะระบบเว็บไซต์ของกระทรวงศึกษาธิการสหรัฐ แต่ล้มเหลว ขณะที่ OpenAI ยังไม่ยืนยันเหตุการณ์ดังกล่าว
อ่านเพิ่มเติม: ซีอีโอ Coinbase ดันวัฒนธรรมรับผิดชอบภายใน รับมือทราฟฟิกจากเอเจนต์ AI พุ่งสูง
เสียงวิจารณ์จาก Marcus Hutchins
ผู้เชี่ยวชาญความปลอดภัยไซเบอร์ Marcus Hutchins ออกมาวิจารณ์ว่า OpenAI “กำลังใช้งานโมเดลเหล่านี้อย่างประมาทเกินไป” โดยรันอยู่ในสภาพแวดล้อมที่กั้นขอบเขต (sandbox) ได้ไม่ดีพอ และขาดการเฝ้าระวังแบบใกล้ชิดจนไม่สามารถกดหยุดได้ทันท่วงที ขณะที่ ส.ส. Ted Lieu พรรคเดโมแครตจากรัฐแคลิฟอร์เนีย แสดงท่าทีรุนแรงยิ่งกว่า โดยเรียกโมเดลต้นทางว่า “ผิดเพี้ยนและไร้ศีลธรรม” พร้อมเรียกร้องให้บริษัทต่าง ๆ เริ่มพัฒนาใหม่ตั้งแต่ต้น
OpenAI ระบุว่าจะกลับมาเดินหน้าเทรนโมเดล “ก็ต่อเมื่อมั่นใจแล้วว่าได้เพิ่มมาตรการป้องกันเพิ่มเติมเพียงพอ” และคาดว่าจะต้อง “กดพัก” กระบวนการอีกหลายครั้งในระหว่างที่เทคโนโลยียังพัฒนาอย่างรวดเร็ว ด้านคู่แข่งอย่าง Anthropic ก็ยอมรับว่าเอเจนต์ของตนเคยหลุดออกจากสภาพแวดล้อมทดสอบ และแฮ็กองค์กรได้สามแห่งในระหว่างการทดลอง สะท้อนความเสี่ยงเชิงระบบที่กำลังเร่งตัวขึ้น ขณะที่ฝ่ายการเมืองในสหรัฐยังเห็นต่างกันว่าจะให้การกำกับดูแลภาครัฐเข้มข้นเพียงใด
ลำดับเหตุเอเจนต์ของ OpenAI
ประธานเจ้าหน้าที่บริหาร Sam Altman ระบุว่า การโจมตีแพลตฟอร์ม Hugging Face เมื่อเดือนกรกฎาคม “ยังเป็นเหตุการณ์ร้ายแรงที่สุดเท่าที่เราเคยเจอ” พร้อมยอมรับด้วยว่า บริษัท “ตอบสนองต่อการละเมิดต่าง ๆ ได้ไม่เร็วเท่าที่เราต้องการ”
เหตุการณ์ดังกล่าวมีรายงานว่ากระทบบัญชีผู้ใช้บนบริการสี่แพลตฟอร์ม และจุดชนวนให้วุฒิสภาสหรัฐเปิดการสอบสวน OpenAI ตอบสนองในเดือนสิงหาคมด้วยการพักกระบวนการเสริมการเรียนรู้จากการเสริมแรง (reinforcement learning) เป็นเวลา 2 สัปดาห์ ควบคู่กับการยกระดับมาตรการรักษาความปลอดภัย และยังคงชะลอการรันเทรนโมเดลขนาดใหญ่ที่สุดในแผนงานออกไป
เมื่อสัปดาห์ที่ผ่านมา ยังมีรายงานเพิ่มเติมว่า เอเจนต์ของ OpenAI เคยหลุดผ่านข้อจำกัดบนพอร์ทัลสถิติ Medicare ของออสเตรเลียตั้งแต่เดือนมิถุนายน แต่หน่วยงานที่เกี่ยวข้องเพิ่งได้รับแจ้งเตือนในเดือนนี้ สะท้อนความท้าทายด้านความโปร่งใสและการรายงานเหตุผิดปกติที่กำลังถูกเพ่งเล็งมากขึ้น
อ่านต่อ: เอเจนต์ AI อาจเปลี่ยนช่องว่างดอกเบี้ย 490 ดอลลาร์ ให้กลายเป็นความเสี่ยงด้านเงินทุนของธนาคาร

