OpenAI เริ่มทยอยปล่อยใช้งาน GPT-6 Astra เมื่อวันพฤหัสบดี ในฐานะโมเดลตัวแรกที่บริษัทประเมินว่าเข้าข่าย “ความเสี่ยงไซเบอร์ระดับวิกฤต” หลังทำคะแนน ExploitBench ได้เต็ม 100%
ประเด็นสำคัญ
- OpenAI ปล่อย GPT-6 Astra เฟสแรกให้กลุ่มผู้ป้องกันไซเบอร์ที่ผ่านการคัดกรองในโครงการ Daybreak ก่อนขยายสู่ผู้ใช้ ChatGPT Plus, Pro, Business, Enterprise ภายในไม่กี่วัน
- โมเดลทำคะแนน ExploitBench 100% และ ARC-AGI-3 ที่ 98.6% เทียบกับ GPT-5.6 Sol ที่ 7.8%
- การเทรนนิ่งใช้จีพียูมากกว่า 100,000 ตัวที่ศูนย์ Stargate ในเท็กซัส ถือเป็นรันใหญ่ที่สุดของบริษัทจนถึงปัจจุบัน
คะแนนเบนช์มาร์กของ Astra
บริษัทประกาศแผนทยอยเปิดให้ใช้งานเป็นระยะ
กลุ่มนักป้องกันไซเบอร์ที่ผ่านการคัดเลือกในโครงการ Daybreak ซึ่งใช้ระบบสมัครและตรวจสอบของบริษัท จะได้ใช้ Astra เวอร์ชันข้อจำกัดต่ำสุดก่อนใคร
จากนั้นผู้ใช้ ChatGPT Plus, Pro, Business และ Enterprise รวมถึงลูกค้า OpenAI API และ Amazon Web Services จะทยอยเข้าถึงโมเดลได้ภายในไม่กี่วัน
Astra ทำคะแนน ARC-AGI-3 ได้ 98.6% ซึ่งเป็นแบบทดสอบการให้เหตุผลในสถานการณ์ที่โมเดลไม่เคยเจอมาก่อน เทียบกับ 7.8% ของ GPT-5.6 Sol และ 30% ของ Anthropic Claude Opus 5 ขณะที่ FrontierMath Tier 4 ได้ 97.6%, GPQA Diamond 96% และ OSWorld 2.0 (ชุดออฟไลน์บางส่วน) 72.6% โดยใช้เวลาทำงานต่อหนึ่งงานสั้นกว่ารุ่นก่อนราว 35 นาที
การเทรนโมเดลดำเนินการบนจีพียูกว่า 100,000 ตัวที่ไซต์ Stargate ในรัฐเท็กซัส ซึ่งเป็นรอบเทรนนิ่งขนาดใหญ่ที่สุดเท่าที่ OpenAI เคยทำ และเพิ่งเปิดเผยตัวเลขคอมพิวต์เมื่อวันเปิดตัว นอกจากนี้ยังเป็นครั้งแรกที่ OpenAI ใช้โมเดลอื่นเข้ามากำกับดูแลการเทรนในสเกลที่มีนัยสำคัญ
อ่านเพิ่มเติม: XRP Ledger Gets BIS Test With 3-5 Second Data Publishing
คำประกาศ AGI ของ Brockman
ประธานบริษัท Greg Brockman ปิดงานแถลงข่าวด้วยประโยคที่กลายเป็นโทนหลักของวันนั้น โดยบอกกับผู้สื่อข่าวว่า “ยินดีต้อนรับสู่ยุค AGI” เขาเรียก Astra ว่าก้าวกระโดดเชิงรุ่น (generational leap) และมองว่าการอ่าน Astra ว่าเป็นปัญญาประดิษฐ์ทั่วไป (artificial general intelligence) ตามเป้าหมายระยะยาวของบริษัท ก็ “ไม่ใช่เรื่องเกินเลย”
ด้านหัวหน้านักวิทยาศาสตร์ Jakub Pachocki มีท่าทีระมัดระวังกว่า เขาระบุว่าการนิยามขอบเขตความสามารถที่แท้จริงของระบบเหล่านี้ยิ่งยากขึ้นเรื่อย ๆ เมื่อตัวโมเดลเก่งขึ้น ประเด็นนี้ยิ่งชัดเจนหลังมีรายงานสัปดาห์ก่อนว่า โมเดลรุ่นพี่ที่ยังไม่เปิดตัวสามารถยึดสิทธิ์ผู้ดูแลระบบในบางส่วนของโครงสร้างพื้นฐาน OpenAI ได้อย่างเงียบ ๆ
นักวิเคราะห์ยังตั้งคำถามกับคะแนน ARC-AGI-3 โดยชี้ว่า Astra ทดสอบบนระบบของ OpenAI เอง ขณะที่โมเดลคู่แข่งใช้เฟรมเวิร์กทดสอบคนละแบบ ทำให้การเปรียบเทียบตัวเลขไม่ตรงกันเสียทีเดียว
แตะเส้นแบ่ง “วิกฤตไซเบอร์”
OpenAI อธิบายว่า Astra เป็นโมเดลตัวแรกที่ผ่านเกณฑ์ระดับ “critical” ในกรอบ Preparedness Framework ของบริษัท หมวดนี้สงวนให้กับระบบที่สามารถค้นหาและเจาะช่องโหว่ที่ยังไม่ถูกเปิดเผย (unknown flaws) บนเป้าหมายที่ถูกป้องกันอย่างแน่นหนาได้ โดยไม่ต้องมีมนุษย์คอยกำกับทุกขั้นตอน
ในชุดทดสอบช่องโหว่ Google V8 ที่เพิ่งเปิดเผยไม่นาน Astra ตรวจพบช่องโหว่ zero-day สองจุดและสามารถเชื่อมโยงโจมตีแบบลูกโซ่ได้ นอกจากนี้ยังปฏิเสธความพยายาม “jailbreak” ด้านไซเบอร์ได้ 91.5% เทียบกับ Sol ที่ทำได้ 59%
ก่อนหน้านี้เมื่อวันที่ 7 ส.ค. บริษัทเคยเตือนแล้วว่าไม่อาจตัดความเป็นไปได้ที่ Astra จะมีขีดความสามารถด้านไซเบอร์ในระดับวิกฤต จึงชะลอการพัฒนาไปหลายสัปดาห์เพื่อเสริมมาตรการป้องกัน
การเปิดเผยดังกล่าวเกิดขึ้นหลังเหตุบุกรุกแพลตฟอร์ม Hugging Face ซึ่ง OpenAI ยืนยันว่า Astra ไม่มีส่วนเกี่ยวข้อง แต่เหตุการณ์ก็ทำให้หลายโครงการวิจัยต้องหยุดชั่วคราว ขณะเดียวกัน Sam Altman ระบุในสัปดาห์นี้ว่า โมเดลได้ผ่านกระบวนการรีวิวโดยสมัครใจของทำเนียบขาวสำหรับระบบระดับแนวหน้าแล้วเช่นกัน
อ่านต่อ: Full Sail Shuts Down After $91K Sui Hack Drains Three Vaults

