OpenAI, GPT-5.6 Sol modelini standart çalışmaya kıyasla 14 kata kadar hızlandıran ve saniyede 750’ye kadar çıktı token’ı üretebilen yeni önizleme katmanı Ultrafast’ı duyurdu.
Öne Çıkan Noktalar:
- Ultrafast, GPT-5.6 Sol’u standart işlem modundan 14 kata kadar daha hızlı çalıştırıyor.
- Modun altyapısını sağlayan Cerebras, saniyede 750 çıktı token’ına kadar hız sunuyor.
- Hizmet şu anda sınırlı önizleme aşamasında; kapasite arttıkça erişimin genişletilmesi planlanıyor.
OpenAI Ultrafast Önizlemesi
OpenAI, 13 Ağustos’ta yayımladığı duyuruda Ultrafast’i ilk etapta yalnızca sınırlı sayıdaki kurumsal müşteriye API üzerinden açtığını bildirdi. Şirket, altyapı kapasitesi büyüdükçe daha fazla müşteriye erişim verileceğini vurguladı.
Hizmetin altyapısı Cerebras tarafından sağlanıyor ve tasarımı GPT-5.6 Sol’un yeteneklerini korurken yanıt üretim süresini ciddi biçimde kısaltmaya odaklanıyor. Çıktı token’ları, modelin ürettiği metnin yapıtaşları olarak tanımlanıyor. OpenAI, gerçek zamana yakın performans isteyen kullanıcıların bugüne kadar genellikle daha küçük veya dar uzmanlaşmış modelleri tercih etmek zorunda kaldığını, Ultrafast’in ise “saniye başına daha fazla işe yarar çıktı” hedeflediğini belirtiyor.
OpenAI, en çok fayda sağlamasını beklediği alanlar arasında olay müdahalesi, finansal araştırma, müşteri hizmetleri, e-ticaret ve canlı araştırma iş akışlarını sayıyor. Mühendisler, bir kesinti sırasında log, izleme verisi ve son kod değişikliklerini Ultrafast üzerinden incelerken; müşteri destek sistemleri de canlı görüşmelerde çok adımlı talepleri anlık olarak işleyebilecek.
Ayrıca Oku: Anthropic 6 Milyar Dolarlık Decart Anlaşmasının Peşinde, Halka Arz Hazırlığında
GPT-5.6 Sol’a Etkisi
İlk kurumsal kullanıcılar, hız artışının modelin etkileşimli iş akışlarındaki rolünü dönüştürdüğünü aktarıyor. Jane Street’ten John Crepezzi, performanstaki sıçramayı “etkileyici” olarak nitelendirirken, bu sayede modellerle yan yana, odaklı çalışmanın çok daha uygulanabilir hale geldiğini söylüyor.
Sesli yapay zekâ ürün lideri Courtland Lykins, Ultrafast’in Podium’un ses altyapısında kritik rol oynadığını ve “hızın, karmaşık işlemlerde çağrı deneyimini tamamen değiştirdiğini” ifade ediyor. OpenAI, finansal araştırmacıların da yavaş, toplu işlem tarzı analizleri beklemek zorunda kalmadan, hızla değişen piyasa sinyallerini ve işlemleri anlık olarak tarayabildiğini belirtiyor. Bu kullanım senaryosu, girdilerin sürekli ve hızlı biçimde güncellenebilmesine dayanıyor.
Önizleme aşaması, geniş bir kamuya açık lansmandan ziyade altyapı kapasitesiyle sınırlı. OpenAI, ilk kurumsal müşterilerden gelen geri bildirimleri kullanarak hız artışının en fazla değer yarattığı alanları tespit etmeye, ardından erişimi kademeli olarak artırmaya hazırlanıyor.
Cerebras işbirliği Ultrafast’ten önceye dayanıyor. OpenAI, ocak ayında yonga üreticisiyle 750 megavatlık düşük gecikmeli yapay zekâ hesaplama kapasitesini platformuna eklemek için ortaklık açıklamıştı. Şubat ayında ise GPT-5.3-Codex-Spark, bu işbirliğine bağlı ilk model oldu ve Cerebras donanımı sayesinde gerçek zamanlı kodlama senaryolarında saniyede 1.000 token sınırını aşmayı başardı.
Sıradaki Haber: Virtuals Protocol İşlem Hacmi %180 Sıçradı, Boğalar 0,68 Doları Hedefliyor





