OpenAI เปิดตัว Ultrafast ชั้นบริการแบบพรีวิวที่ออกแบบมาเพื่อเพิ่มความเร็วการประมวลผลของ GPT-5.6 Sol ให้สูงสุดถึง 14 เท่า เมื่อเทียบกับโหมดมาตรฐาน พร้อมรองรับการสร้างเอาต์พุตได้สูงสุดราว 750 โทเคนต่อวินาที
ประเด็นสำคัญ
- Ultrafast ทำให้ GPT-5.6 Sol ทำงานได้เร็วขึ้นสูงสุด 14 เท่าเมื่อเทียบกับการประมวลผลปกติ
- โหมดนี้ขับเคลื่อนด้วยเทคโนโลยีของ Cerebras รองรับเอาต์พุตได้สูงสุดประมาณ 750 โทเคนต่อวินาที
- ขณะนี้ยังเป็นบริการตัวอย่างแบบจำกัดกลุ่ม ก่อนจะขยายการเข้าถึงตามความพร้อมด้านโครงสร้างพื้นฐาน
พรีวิว OpenAI Ultrafast
OpenAI ประกาศ เปิดตัว Ultrafast เมื่อวันที่ 13 สิงหาคม เริ่มให้ใช้งานผ่าน API สำหรับลูกค้ากลุ่มเล็กเป็นลำดับแรก โดยบริษัทระบุว่าจะทยอยเปิดกว้างให้ลูกค้ากลุ่มกว้างขึ้นเมื่อกำลังประมวลผลรองรับได้มากพอ
บริการนี้ขับเคลื่อนด้วยโครงสร้างพื้นฐานของ Cerebras และถูก ออกแบบ ให้คงความสามารถเต็มรูปแบบของ GPT-5.6 Sol ไว้ ขณะเดียวกันก็ลดเวลาที่ใช้ในการสร้างคำตอบ “โทเคนเอาต์พุต” คือหน่วยย่อยของข้อความที่โมเดลสร้างขึ้น OpenAI ชี้ว่า เดิมทีการทำงานใกล้เรียลไทม์มักบังคับให้ผู้ใช้เลือกโมเดลที่เล็กกว่าหรือเฉพาะทางมากกว่า แต่ Ultrafast ตั้งเป้าเพิ่ม “ปริมาณงานที่มีประโยชน์ต่อวินาที” แทน
OpenAI มองว่าเวิร์กโฟลว์ที่จะได้ประโยชน์สูงสุด ได้แก่ งานรับมือเหตุขัดข้อง (incident response) การวิจัยการเงิน งานสนับสนุนลูกค้า อีคอมเมิร์ซ และการวิจัยแบบเรียลไทม์ วิศวกรสามารถใช้โหมดนี้ช่วยวิเคราะห์ล็อก เทรซ และโค้ดที่เพิ่งเปลี่ยนแปลง ระหว่างที่เหตุขัดข้องยังดำเนินอยู่ ส่วนระบบบริการลูกค้าสามารถจัดการคำขอหลายขั้นตอนในระหว่างการสนทนาจริงได้อย่างลื่นไหล
อ่านเพิ่มเติม: Anthropic เดินหน้าเจรจาเข้าซื้อ Decart มูลค่า 6 พันล้านดอลลาร์ พร้อมปูทางสู่การเข้าตลาดหุ้น
ผลกระทบของ GPT-5.6 Sol
ลูกค้าช่วงแรกระบุว่า ความเร็วที่เพิ่มขึ้นเปลี่ยนบทบาทของโมเดลในการทำงานเชิงโต้ตอบอย่างมีนัยสำคัญ John Crepezzi จาก Jane Street ระบุว่า การเร่งความเร็วครั้งนี้ “น่าประทับใจ” และทำให้การทำงานแบบโฟกัสร่วมกับโมเดลเป็นเรื่องปฏิบัติได้จริงมากขึ้น
Courtland Lykins หัวหน้าผลิตภัณฑ์ด้าน Voice AI ของ Podium กล่าวว่า Ultrafast มีคุณค่าอย่างมากต่อสแต็กเสียงของบริษัท เพราะ “ความเร็วเปลี่ยนประสบการณ์การโทรบนงานซับซ้อนไปโดยสิ้นเชิง” ขณะเดียวกัน OpenAI ระบุว่านักวิจัยการเงินสามารถวิเคราะห์สัญญาณตลาดและธุรกรรมที่เปลี่ยนแปลงตลอดเวลาได้ทันที โดยไม่ต้องรอการประมวลผลแบบแบตช์ที่ล่าช้า ซึ่งกรณีใช้งานดังกล่าวพึ่งพาข้อมูลอินพุตที่เปลี่ยนเร็วเป็นหลัก
ทั้งนี้ พรีวิวยังถูกจำกัดด้วยข้อจำกัดด้านโครงสร้างพื้นฐาน มากกว่าการเปิดให้ใช้แบบสาธารณะวงกว้าง OpenAI ระบุว่ากำลังใช้ข้อเสนอแนะจากลูกค้ากลุ่มแรก เพื่อตัดสินใจว่าความเร็วที่สูงขึ้นสร้างมูลค่าเพิ่มสูงสุดในเวิร์กโฟลว์ประเภทใด ก่อนขยายการให้บริการ
ความร่วมมือกับ Cerebras เริ่มต้นก่อนหน้า Ultrafast โดย OpenAI เคยประกาศจับมือกับผู้ผลิตชิปรายนี้เมื่อเดือนมกราคม เพื่อเพิ่มกำลังประมวลผล AI แบบหน่วงต่ำ (low-latency) อีก 750 เมกะวัตต์ให้แพลตฟอร์มของตน จากนั้นในเดือนกุมภาพันธ์ GPT-5.3-Codex-Spark กลายเป็นโมเดลแรกภายใต้ดีลดังกล่าว โดยใช้ฮาร์ดแวร์ของ Cerebras ทำความเร็วสร้างโค้ดแบบเรียลไทม์ทะลุ 1,000 โทเคนต่อวินาที
อ่านต่อ: ปริมาณซื้อขาย Virtuals Protocol พุ่ง 180% กระทิงเล็งเป้าราคา 0.68 ดอลลาร์





