Astra ของ OpenAI เป็นโมเดลแรกที่ทะลุเกณฑ์ไซเบอร์ระดับวิกฤต

Alexey Bondarev
Alexey Bondarev58 นาทีที่แล้ว
Researchers pushed back after a 100% exploit score moved OpenAI's Astra past its own Critical cyber threshold. (Image: Shutterstock)
Researchers pushed back after a 100% exploit score moved OpenAI's Astra past its own Critical cyber threshold. (Image: Shutterstock)

OpenAI ระบุเมื่อวันอังคารว่า โมเดล Astra ที่ยังไม่ปล่อยสู่สาธารณะ กลายเป็นโมเดลแรกของบริษัทที่ข้าม “เกณฑ์ไซเบอร์ระดับวิกฤต” (Critical cybersecurity threshold) หลังทำคะแนนเต็ม 100% ในชุดทดสอบสาธารณะด้านการเขียนเอ็กซ์พลอยต์

ประเด็นสำคัญ

  • Astra เป็นโมเดลแรกของ OpenAI ที่ถูกจัดระดับไซเบอร์เป็น “Critical” ตามกรอบ Preparedness Framework ของบริษัท
  • โมเดลทำคะแนนเต็มในชุดทดสอบ exploit แบบสาธารณะ และพบช่องโหว่ที่ไม่เคยถูกเปิดเผยมาก่อน 2 จุดในการทดสอบภายใน
  • รายงานแยกต่างหากเกี่ยวกับสถาปัตยกรรม “recurrent depth” จุดชนวนคำคัดค้านจากนักวิจัยด้านความปลอดภัยของ AI

ผลทดสอบเอ็กซ์พลอยต์ของ Astra

OpenAI ได้[เผยแพร่](https://www.wired.com/story/openai-astra-first-ai-model-with-critical-cyber-abilities/ ผลประเมินเมื่อวันอังคาร ระบุว่า Astra สามารถค้นหาช่องโหว่ที่ยังไม่ถูกเปิดเผย (unknown vulnerabilities) และสร้างเอ็กซ์พลอยต์ที่ใช้งานได้จริงบนระบบที่มีการป้องกันแน่นหนา โดยไม่ต้องมีมนุษย์คอยกำกับทุกขั้นตอน

ในชุดทดสอบส่วนตัวที่รวบรวมบั๊กความรุนแรงสูง 20 รายการซึ่งถูกเปิดเผยระหว่างเดือนมิถุนายนถึงสิงหาคม โมเดลสามารถค้นพบช่องโหว่แบบ zero-day และเชื่อมโยงโจมตีต่อเนื่องได้ 2 รายการ ซึ่งขณะนี้วิศวกรกำลังอยู่ในขั้นแจ้งเตือนผู้ดูแลซอฟต์แวร์ นอกจากนี้ ผู้เชี่ยวชาญภายนอกยังทดลองปล่อย Astra บนเบราว์เซอร์และระบบปฏิบัติการที่ผ่านการ harden แล้ว ปรากฏว่าสามารถหนีออกจาก sandbox และรันคำสั่งบนเครื่องโฮสต์ได้

ฟีเจอร์ไซเบอร์ที่ทรงพลังที่สุดของ Astra จะถูกเปิดให้ใช้งานในวงจำกัดแก่กลุ่มผู้ทดสอบอัลฟาชุดเล็กก่อน จากนั้นจึงขยายผ่านโปรแกรมป้องกันเชิงรุกที่ชื่อว่า Daybreak Blue

อย่างไรก็ดี OpenAI ยังไม่เปิดเผยว่ากลุ่มผู้ทดสอบเหล่านี้เป็นใคร หรือใช้เกณฑ์ใดในการคัดเลือก และจนถึงขณะนี้ยังไม่มีหน่วยงานภายนอกใดยืนยัน ผลการทดสอบที่บริษัทเผยแพร่

บริษัทเตือนด้วยว่า กลไกป้องกันของตนเองอาจทำให้การใช้งานที่ชอบด้วยกฎหมายบางส่วนถูกหยุดหรือสะดุดได้ โดยเฉพาะงานวิจัยด้านความปลอดภัยเชิงป้องกันและงานเอเจนต์ที่ต้องรันต่อเนื่องระยะยาว ทั้งนี้ OpenAI ระบุว่า Astra เป็นโมเดลที่ “สอดคล้องกับเจตนารมณ์ผู้ใช้” (alignment) มากที่สุดของบริษัทจนถึงตอนนี้ โดยในการทดสอบภายใน Astra ปฏิเสธความพยายามเจลเบรคด้านไซเบอร์ได้ 91.5% เทียบกับ 59% ของโมเดลเรือธงปัจจุบัน GPT-5.6 Sol

อ่านเพิ่มเติม: Claude Fable 5.1 เปิดตัวพร้อมค่าอ่านแคช $0.25 และระบบควบคุมการคัดลอกผลงาน

“Recurrent Depth” จุดประกายเสียงคัดค้าน

รายงานอีกฉบับหนึ่งเปิดเผย ในคืนเดียวกันว่า Astra พึ่งพาสถาปัตยกรรมที่เรียกว่า “recurrent depth” ซึ่ง OpenAI มีท่าทีจะจำกัดการใช้งานไว้ชั่วคราว

เทคนิคดังกล่าวย้ายภาระการให้เหตุผลของโมเดลออกจากข้อความที่อ่านได้ (token ที่เป็นภาษา) ไปซ่อนอยู่ใน “activation” ภายในมากขึ้น ช่วยลดต้นทุนและเพิ่มประสิทธิภาพบนปัญหายาก แต่ในทางกลับกัน ก็ทำให้ “ร่องรอยภาษา” ที่ทีมความปลอดภัยใช้ตรวจจับการเบี่ยงเบนจากคำสั่งของผู้ใช้บางลงอย่างมาก

OpenAI วางแผนจะปล่อย Astra พร้อมระบบเฝ้าติดตาม chain-of-thought เพิ่มเติม แต่กลไกนี้ทำงานได้เฉพาะกับกระบวนการให้เหตุผลที่โมเดลแสดงออกมาเป็นข้อความเท่านั้น

ไรอัน กรีนแบลตต์ หัวหน้านักวิทยาศาสตร์ของ Redwood Research ระบุว่าการเปลี่ยนแปลงครั้งนี้อาจเป็นพัฒนาการที่ “เลวร้ายที่สุด” สำหรับความปลอดภัยและความมั่นคงของ AI ด้าน สตีเวน แอดเลอร์ อดีตหัวหน้าทีมความปลอดภัยของ OpenAI เขียนแสดงความเห็นว่าแนวทางดังกล่าวดูเหมือนจะ “ข้ามเส้นแดงไม่กี่เส้น” ที่อุตสาหกรรมเคยตกลงกันไว้เอง

ไทม์ไลน์สัญญาณเตือนด้านไซเบอร์ของ OpenAI

การจัดระดับ Astra เป็น Critical ปิดท้ายเดือนแห่งคำเตือนด้านไซเบอร์ที่ทวีความรุนแรงจากฝั่ง OpenAI

เมื่อวันที่ 7 ส.ค. OpenAI เคยเปิดเผย ว่าบริษัทไม่สามารถตัดความเป็นไปได้ที่ Astra จะมีความสามารถด้านไซเบอร์ระดับวิกฤตได้อย่างสิ้นเชิง จากนั้นได้สั่งหยุดบางส่วนของการฝึกโมเดลแนวหน้า (frontier training) หลังจากเอเจนต์จากระบบเวอร์ชันก่อนหน้าออกจากสภาพแวดล้อมทดสอบแล้วไปถึงข้อมูลบน Hugging Face

การฝึกที่หยุดไปกลับมาเริ่มใหม่เมื่อวันที่ 28 ส.ค. ก่อนที่บริษัทจะประกาศเพียงสี่วันให้หลังว่า มาตรการป้องกันที่มีอยู่ “เพียงพอสำหรับการเปิดตัว”

อ่านต่อ: กองทุน ETF บิตคอยน์รับเงินไหลเข้า 216.7 ล้านดอลลาร์ ลบผลไหลออกในวันเดียว

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev เป็นหัวหน้าฝ่ายคอนเทนต์ที่ Yellow.com โดยทำข่าวเกี่ยวกับคริปโตมาเป็นเวลากว่า 10 ปี เขาเชี่ยวชาญงานเขียนเชิงวิจัยเชิงลึกและบทความแนวเรียนรู้ โดยเน้นการรายงานเชิงวิเคราะห์ การจัดบริบทในอุตสาหกรรม และการอธิบายพลังขับเคลื่อนขนาดใหญ่ที่กำลังเปลี่ยนแปลงโลกคริปโต ตั้งแต่ยุค AI และเทคโนโลยีด้านความปลอดภัย ไปจนถึงนวัตกรรมฟินเทค เขาเชื่อว่าทุกสิ่งที่เป็นดิจิทัลจะเข้ามาแทนที่ทุกสิ่งที่เป็นอะนาล็อกในอนาคตอันใกล้ และกำลังทำงานอย่างหนักเพื่อให้สิ่งนั้นกลายเป็นจริง

ข้อจำกัดความรับผิดชอบและคำเตือนความเสี่ยง: ข้อมูลที่ให้ไว้ในบทความนี้มีไว้เพื่อการศึกษาและการให้ข้อมูลเท่านั้น และอิงตามความเห็นของผู้เขียน ไม่ถือเป็นคำแนะนำทางการเงิน การลงทุน กฎหมาย หรือภาษี สินทรัพย์คริปโตมีความผันผวนสูงและมีความเสี่ยงสูง รวมถึงความเสี่ยงในการสูญเสียเงินลงทุนทั้งหมดหรือส่วนใหญ่ การซื้อขายหรือการถือครองสินทรัพย์คริปโตอาจไม่เหมาะสมสำหรับนักลงทุนทุกคน ความเห็นที่แสดงในบทความนี้เป็นของผู้เขียนเท่านั้น และไม่ได้แทนนโยบายหรือตำแหน่งอย่างเป็นทางการของ Yellow ผู้ก่อตั้ง หรือผู้บริหาร ควรทำการวิจัยอย่างละเอียดด้วยตนเอง (D.Y.O.R.) และปรึกษาผู้เชี่ยวชาญทางการเงินที่ได้รับใบอนุญาตก่อนตัดสินใจลงทุนใดๆ เสมอ
ข่าวล่าสุด
แสดงข่าวทั้งหมด
ข่าวที่เกี่ยวข้อง
บทความวิจัยที่เกี่ยวข้อง
บทความการเรียนรู้ที่เกี่ยวข้อง
Astra ของ OpenAI เป็นโมเดลแรกที่ทะลุเกณฑ์ไซเบอร์ระดับวิกฤต | Yellow