OpenAI ยืนยันเมื่อ 1 ส.ค. ว่า “Astra” คือชื่อโมเดลหลักตระกูลถัดไปของบริษัท โมเดลต้นแบบนี้ยังไม่เปิดให้ใช้งานจริง แต่ถูกระบุในงานวิจัยว่าเป็น ระบบที่แก้ปัญหาคณิตศาสตร์ได้ 10 ข้อ เปิดตัวตามหลัง Claude Opus 5 ของ Anthropic เพียงหนึ่งสัปดาห์
ประเด็นสำคัญ
- OpenAI ระบุชื่อ Astra ครั้งแรก 1 ส.ค. ในบทความวิจัยที่แจกแจงคำตอบโจทย์คณิต 10 ข้อที่ไม่เคยแก้ได้มาก่อน
- Astra ใช้กลยุทธ์ “หลายเอเจนต์รุมโจทย์เดียว” ทำงานต่อเนื่องเป็นชั่วโมงหรือเป็นวัน ยังไม่มีกำหนดเปิดตัวเชิงพาณิชย์
- Claude Opus 5 เปิดขาย 24 ก.ค. ที่ 5 ดอลลาร์ต่อโทเคนอินพุตหนึ่งล้าน และ 25 ดอลลาร์ต่อโทเคนอุตพุตหนึ่งล้าน พร้อมหน้าต่างคอนเท็กซ์ 1 ล้านโทเคน
รายละเอียดโมเดล OpenAI Astra
OpenAI ประกาศ ชื่อ Astra ผ่านบทความวิจัยที่ให้เครดิตกับเวอร์ชันภายในของโมเดลนี้ว่าเป็นผู้อยู่เบื้องหลังการพิสูจน์ผลลัพธ์ใหม่ 10 ชิ้นในคณิตศาสตร์และทฤษฎีวิทยาการคอมพิวเตอร์ แต่ละปัญหาเปิดค้างมานานอย่างน้อยสิบปี งานครอบคลุมทั้งเรขาคณิตมิติสูง ทฤษฎีรหัส และควอนตัมคอมเพล็กซิตี หนึ่งในนั้นยังพิสูจน์การมีอยู่ของ non-sofic groups ได้ด้วย
จุดขายของ Astra ไม่ได้อยู่ที่ความเร็วดิบ แต่เน้น “ความทนระยะยาว” เนื่องจากโมเดลประสานเอเจนต์หลายตัวให้ทำงานร่วมกันบนโจทย์เดียวต่อเนื่องเป็นชั่วโมงหรือยาวไปถึงหลายวัน
รายงานก่อนหน้านี้ระบุว่า Astra ถูกจัดวางไว้ข้างโมเดลตระกูล Sol, Terra และ Luna โดยยังไม่มีวันเปิดตัวแน่ชัด และยังไม่ตัดสินใจว่าจะติดฉลากเป็น GPT-6 หรือ GPT-5.7 Sam Altman เคยนำระบบนี้ไปสาธิตให้ผู้กำหนดนโยบายในกรุงวอชิงตันชม และโมเดลตระกูลนี้คาดว่าจะเป็นชุดแรกที่เข้ากระบวนการตรวจประเมินภายใต้กรอบอนุมัติระดับรัฐบาลกลางชุดใหม่
อ่านเพิ่มเติม: โครงสร้างพื้นฐาน AI: สินเชื่อเงินด่วนหันหัวเรือ 1 พันล้านดอลลาร์รุกดาต้าเซ็นเตอร์
ราคาและผลเทสต์ของ Claude Opus 5
Anthropic เปิดตัว Claude Opus 5 เมื่อ 24 ก.ค. ตั้งราคาอินพุตที่ 5 ดอลลาร์ต่อโทเคนหนึ่งล้าน และอุตพุตที่ 25 ดอลลาร์ต่อโทเคนหนึ่งล้าน เท่ากับที่เคยคิดกับ Opus 4.8 โมเดลนี้ ขึ้นอันดับหนึ่ง บนดัชนี Artificial Analysis Intelligence ที่ 61 คะแนน ขณะที่ต้นทุนต่อหนึ่งงานราวครึ่งเดียวของ Fable 5
Claude Opus 5 รองรับหน้าต่างคอนเท็กซ์ 1 ล้านโทเคน และจำกัดอุตพุตที่ 128,000 โทเคน ผลทดสอบได้ 30.2% บนชุด ARC-AGI-3 สูงกว่าคู่แข่งรายถัดไปประมาณสามเท่า และทำคะแนน 89.1% บน Terminal-Bench 2.1 เมื่อรันเต็มสมรรถนะ โฆษกของ Anthropic แนะนำ ลูกค้าให้ลองรันโมเดลคู่แข่งบนงานสั้นที่กรอบชัดหนึ่งงาน และงานระยะยาวอีกหนึ่งงานก่อนตัดสินใจลงทุน
มุมมองผู้เชี่ยวชาญต่อ Astra
Astra ยังไม่มีทั้งป้ายราคา ตารางเบนช์มาร์ก หรือผลทดสอบโดยบุคคลภายนอก ทำให้ผู้ซื้ออยู่ในสถานะต้องชั่งน้ำหนักระหว่างสินค้าที่วางขายจริงกับผลงานที่ยังอยู่ในห้องวิจัย
Thomas Bloom นักคณิตศาสตร์จากมหาวิทยาลัยแมนเชสเตอร์ ออกความเห็น บน X ว่าผลลัพธ์ทั้งสิบข้อเป็น “ข่าวใหญ่” และจัดอันดับให้เหนือกว่างานพิสูจน์รอบก่อนหน้าของ OpenAI
Bloom ยังโต้เสียงวิจารณ์ที่ว่าระบบนี้จะมาแทนที่นักคณิตศาสตร์ โดยชี้ว่าตัวโมเดลเองถูกสร้างและเทรนขึ้นจากองค์ความรู้ที่นักคณิตศาสตร์เคยเขียนไว้ทั้งสิ้น ขณะเดียวกัน Noam Brown นักวิจัย OpenAI ระบุว่าชุดผลงานครั้งนี้ยังไม่แตะปัญหาระดับ Millennium Prize ใดๆ และทีมไม่ได้ทุ่มทรัพยากรอย่างหนักกับแต่ละปัญหา
นักวิทยาศาสตร์การรู้คิด Gary Marcus ยอมรับ ว่าผลลัพธ์ดังกล่าว “ของจริง” แต่เห็นว่าถูกนำเสนอเกินจริงราวกับว่าพื้นที่วิจัยนี้ถูกปิดจบแล้ว
การประกาศ Astra ต่อเนื่องจากผลงานเมื่อเดือนพฤษภาคมของโมเดลตระกูล long-horizon ชุดเดียวกัน ซึ่งล้ม conjecture ระยะทางหนึ่งหน่วยของ Erdős ปัญหาในเรขาคณิตเชิงไม่ต่อเนื่องที่คาใจวงการมานาน 80 ปี Tim Gowers เจ้าของรางวัลฟิลด์ส เคยให้ความเห็นตอนนั้นว่าเขาพร้อมจะแนะนำให้ลงวารสาร Annals of Mathematics โดยไม่ลังเล
อ่านต่อถัดไป: ข่าวลือ iPhone พับจอเริ่มชัด: ราคา 2,500 ดอลลาร์ ไม่มี Face ID และเลนส์เทเลโฟโต้






