OpenAI ชะลอการพัฒนาโมเดล Astra หลังพบศักยภาพด้านไซเบอร์ระดับวิกฤตอาจเป็นไปได้

New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)

OpenAI ระงับงานวิจัยและทดสอบภายในสำหรับ โมเดล Astra รุ่นถัดไป เมื่อวันศุกร์ โดยระบุว่าไม่สามารถ “ตัดทิ้ง” ความเป็นไปได้ที่โมเดลนี้จะมีความสามารถด้านไซเบอร์โจมตีในระดับวิกฤต ภายใต้กรอบด้านความปลอดภัยที่บริษัทเผยแพร่ตั้งแต่ปี 2023

ประเด็นสำคัญ

  • OpenAI ระบุว่าไม่อาจยืนยันได้ว่า Astra จะไม่แตะระดับ Critical ด้านความปลอดภัยไซเบอร์ตามกรอบความพร้อมใช้งานของบริษัท
  • บริษัทหยุดกิจกรรมภายในที่เกี่ยวกับ Astra ซึ่งยังไม่ผ่านมาตรการควบคุมความปลอดภัยที่เข้มงวด เช่น การทดสอบแบบแยกส่วน (isolated testing) และการรันในสภาพแวดล้อม sandbox
  • โมเดลก่อนหน้าอย่าง GPT-5.6-Sol ถูกจัดอยู่ในระดับ High ไม่ใช่ Critical สำหรับความสามารถด้านไซเบอร์ในแนวหน้าการพัฒนา

การประเมิน Astra กระตุ้นให้ OpenAI กดเบรกด้านความปลอดภัย

ในบล็อกโพสต์ของบริษัท ระบุ ว่าการประเมินในช่วงไม่กี่วันที่ผ่านมาเผยให้เห็นความก้าวหน้าชัดเจนทั้งด้าน “agentic coding” และความสามารถเชิงไซเบอร์ซีเคียวริตี้ ขณะที่ผู้เชี่ยวชาญภายนอกที่เข้าร่วมประเมินก็ให้น้ำหนักไปในทิศทางเดียวกัน ทั้งนี้ Astra ยังไม่ถูกปล่อยสู่สาธารณะ

OpenAI ย้ำว่าโมเดล Astra ไม่ได้มีส่วนเกี่ยวข้องกับเหตุโจมตีระบบของ Hugging Face และเวลาการเปิดตัว (ถ้ามี) ยังไม่ชัดเจน

ภายใต้กรอบดังกล่าว โมเดลจะถูกจัดอยู่ในระดับ Critical หากสามารถค้นหาและพัฒนา “zero-day exploit” ที่ใช้งานได้จริงกับระบบที่ผ่านการเสริมความแข็งแกร่งหลายประเภท โดยไม่ต้องอาศัยการแทรกแซงจากมนุษย์ นอกจากนี้ยังเข้าข่าย Critical หากสามารถวางแผนและดำเนินการโจมตีแบบครบวงจรต่อเป้าหมายที่ป้องกันแน่นหนา โดยเริ่มจากเพียง “เป้าหมายปลายทาง” ที่กำหนดไว้

วิศวกรของ OpenAI จึงจำกัดการเข้าถึงเครือข่ายและเครื่องมือของโมเดล เข้ารหัสน้ำหนัก (model weights) และย้ายงานที่มีความเสี่ยงสูงไปยังสภาพแวดล้อมแยกส่วนที่รันแบบ sandbox

ระบบมอนิเตอร์จะตรวจสอบ “สายโซ่กระบวนคิด” ของโมเดล และสามารถสั่งหยุดกิจกรรมที่ถูกมองว่ามีความเสี่ยง หน่วยงานรัฐและองค์กรด้านความปลอดภัยที่คัดเลือกไว้จะเข้ามามีส่วนร่วมในการทดสอบศักยภาพของ Astra โดยโมเดลก่อนหน้าอย่าง GPT-5.6-Sol ได้รับการจัดระดับเพียง High ไม่ถึงขั้น Critical

อ่านต่อ: ตัวเลขจ้างงานติดลบ นักวิเคราะห์ชี้เส้นทางบิตคอยน์ยังอีกไกลกว่าจะสะอาดตา

Michael Dalton และ Dianne Penn กับการชะลอจังหวะงานวิจัย AI

Michael Dalton หนึ่งในทีมเทคนิคของ OpenAI กล่าวกับผู้เข้าร่วม งานประชุม Black Hat สัปดาห์นี้ว่า บริษัทตั้งใจ “ลดความเร็ว” งานวิจัยเพื่อเพิ่มความปลอดภัยเป็นลำดับแรก ขณะที่เจ้าหน้าที่ทำเนียบขาวรายหนึ่งเปิดเผยว่า OpenAI เสนอแจ้งแผนชะลอการปล่อยโมเดลให้ฝ่ายบริหารทราบด้วยตัวเอง ท่ามกลางความไม่ชัดเจนว่ารัฐบาลจะกำกับตรวจสอบโมเดลแนวหน้าก่อนเปิดตัวอย่างไร

ฝั่งคู่แข่งอย่าง Anthropic ปล่อยเวอร์ชันจำกัดการใช้งานของโมเดลที่มีศักยภาพด้านไซเบอร์สูงสุดของบริษัทชื่อ Mythos เมื่อเดือนมิถุนายน Dianne Penn หัวหน้าสายงานผลิตภัณฑ์ งานวิจัย และห้องแล็บของ Anthropic ระบุว่าการเปิดตัวครั้งนั้นเป็นไปอย่าง “ระมัดระวังเป็นพิเศษ”

Anthropic ได้ปรับถอยจากคำสัญญาเดิมที่ว่าจะหยุดการเทรนโมเดลทรงพลัง ในอัปเดตนโยบายการขยายสเกลเมื่อเดือนกุมภาพันธ์ โดยให้เหตุผลว่าการหยุดฝ่ายเดียวเพียงรายเดียวอาจกลับทำให้ระบบนิเวศด้านความปลอดภัยโดยรวมอ่อนแอลง

ช่องโหว่ Hugging Face และกรณีโมเดลหลุดจาก Sandbox

การประกาศของ OpenAI เกิดขึ้นต่อเนื่องจากความเคลื่อนไหวลักษณะเดียวกันจากหลายบริษัทในอุตสาหกรรม เมื่อเดือนกรกฎาคม มีรายงานว่าโมเดลเวอร์ชันทดสอบก่อนเปิดตัวของ OpenAI สามารถ เจาะระบบ Hugging Face ระหว่างการทำ benchmark ภายใน กลายเป็นกรณีแรกที่มีหลักฐานชัดเจนว่าห้องแล็บควบคุมระบบของตัวเองไม่ได้

ถัดมา Anthropic เปิดเผยว่าโมเดลของบริษัทเคย “เอื้อมเข้าไป” ในเครือข่ายของบริษัทเอกชนสามแห่งระหว่างการทดสอบด้านความปลอดภัย ขณะที่นักวิจัยรายงานในสัปดาห์นี้ว่า Kimi K3 โมเดลของ Moonshot สามารถหลุดออกจากสภาพแวดล้อม sandbox ได้สำเร็จ

ด้าน Meta ก็ออกมา ยืนยัน เมื่อวันพุธว่า โมเดลที่เพิ่งปล่อยออกมาไม่นานสามารถแทรกซึมเข้าเครื่องคอมพิวเตอร์ของบุคคลที่สามได้เช่นกัน กรณีเหล่านี้ทำให้ “สภาพแวดล้อมทดสอบ” ซึ่งเคยถูกมองว่าเป็นพื้นที่ปลอดภัย กลับกลายเป็นจุดที่ถูกจับตาเข้มข้นขึ้น

อ่านถัดไป: ฝั่งกระทิง Cardano เล็งแนวต้าน $0.25 หลัง ADA รีบาวด์แรง 18% ในสัปดาห์

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev เป็นหัวหน้าฝ่ายคอนเทนต์ที่ Yellow.com โดยทำข่าวเกี่ยวกับคริปโตมาเป็นเวลากว่า 10 ปี เขาเชี่ยวชาญงานเขียนเชิงวิจัยเชิงลึกและบทความแนวเรียนรู้ โดยเน้นการรายงานเชิงวิเคราะห์ การจัดบริบทในอุตสาหกรรม และการอธิบายพลังขับเคลื่อนขนาดใหญ่ที่กำลังเปลี่ยนแปลงโลกคริปโต ตั้งแต่ยุค AI และเทคโนโลยีด้านความปลอดภัย ไปจนถึงนวัตกรรมฟินเทค เขาเชื่อว่าทุกสิ่งที่เป็นดิจิทัลจะเข้ามาแทนที่ทุกสิ่งที่เป็นอะนาล็อกในอนาคตอันใกล้ และกำลังทำงานอย่างหนักเพื่อให้สิ่งนั้นกลายเป็นจริง

ข้อจำกัดความรับผิดชอบและคำเตือนความเสี่ยง: ข้อมูลที่ให้ไว้ในบทความนี้มีไว้เพื่อการศึกษาและการให้ข้อมูลเท่านั้น และอิงตามความเห็นของผู้เขียน ไม่ถือเป็นคำแนะนำทางการเงิน การลงทุน กฎหมาย หรือภาษี สินทรัพย์คริปโตมีความผันผวนสูงและมีความเสี่ยงสูง รวมถึงความเสี่ยงในการสูญเสียเงินลงทุนทั้งหมดหรือส่วนใหญ่ การซื้อขายหรือการถือครองสินทรัพย์คริปโตอาจไม่เหมาะสมสำหรับนักลงทุนทุกคน ความเห็นที่แสดงในบทความนี้เป็นของผู้เขียนเท่านั้น และไม่ได้แทนนโยบายหรือตำแหน่งอย่างเป็นทางการของ Yellow ผู้ก่อตั้ง หรือผู้บริหาร ควรทำการวิจัยอย่างละเอียดด้วยตนเอง (D.Y.O.R.) และปรึกษาผู้เชี่ยวชาญทางการเงินที่ได้รับใบอนุญาตก่อนตัดสินใจลงทุนใดๆ เสมอ
ข่าวที่เกี่ยวข้อง
บทความวิจัยที่เกี่ยวข้อง
บทความการเรียนรู้ที่เกี่ยวข้อง
OpenAI ชะลอการพัฒนาโมเดล Astra หลังพบศักยภาพด้านไซเบอร์ระดับวิกฤตอาจเป็นไปได้ | Yellow