OpenAI, GPT-6 Astra'daki Ani Performans Düşüşünün Ardındaki Üç Kusuru Açıkladı

DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)
DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)

OpenAI, yeni GPT-6 Astra modelinin lansmandan sonra “aptallaştığı” yönündeki bir haftalık şikâyetlerin arkasındaki üç temel kusuru giderdi ve Codex abonelerinin kullanım limitlerini sıfırlamaya başladı.

Öne çıkanlar

  • Astra kullanıcıları, modelin lansmandan bu yana sessizce zayıflatıldığını iddia eden yan yana test sonuçlarını hafta boyunca X’te paylaştı.
  • OpenAI’in Codex ürün lideri, yaklaşık 4.000–5.000 kullanıcıyı etkileyen bir bağlam yönetimi deneyi de dahil olmak üzere üç nedeni sıraladı.
  • Şirketin önceki amiral gemisi GPT-5.6 Sol da temmuz ayında aynı “bilerek zayıflatma” suçlamasıyla karşı karşıya kalmıştı.

OpenAI, Astra’daki kalite kusurlarını giderdi

Codex ürün sorumlusu Tibo Sottiaux, ekibin kullanıcılarla birlikte çalışarak sorunların kaynağını tespit ettiğini, ardından düzeltmeleri devreye alıp gece yarısından önce tam kullanım sıfırlamasına gittiklerini cumartesi günü yayımlanan bir güncellemede aktardı.

Açıklamaya göre, önceki modellere göre yazılmış “beceriler” Astra’da gereğinden sık tetikleniyor, bu da modelin kendi çıktısını yeniden kontrol etmesini zaman zaman engelliyordu.

İsteğe bağlı bir bağlam yönetimi deneyi de modelin yanıtlarını erken kesmesine veya eski iletilere cevap vermesine neden olabiliyordu; OpenAI bu deneyi yaklaşık 4.000–5.000 kullanıcının etkilenmesinin ardından devre dışı bıraktı. Bazı altyapı motorlarının yanlış yapılandırıldığı, bu motorlar üzerinden akan “kuyruk trafiğinde” ölçülebilir kalite kaybına yol açtığı tespit edildi; şirket bu motorları devreden çıkardı ve birkaç ek ince ayar yaptı.

Sottiaux, modelin artık kullanıcının son mesajını daha isabetli bir şekilde takip ettiğini yazdı.

Ayrıca bakınız: Ethereum Faces $2,800 Supply Wall After ETF Inflows Jump To $216M

Astra kullanıcıları kod kalitesinde gerileme bildiriyor

Hafta boyunca X’te biriken şikâyetlerde geliştiriciler, lansman günündeki Astra ile güncel sürümü aynı girdiler ve aynı ayarlarla çalıştırıp sonuçları yan yana karşılaştırdı.

Daha önce modeli öven geliştirici Pranjal Paliwal, Astra’nın kendisi için ürettiği kodu yeniden inceleyip çıktıları değerlendirdikten sonra, yaşananın bir ilerleme değil “regresyon” olduğunu savundu.

Kodlama aracı Opencode’un arkasındaki isim Dax Raad ise, Astra’ya geçtikten sonra maliyetler ikiye katlanırken çıktılardaki dezavantajların bu fiyatı haklı çıkarmadığı gerekçesiyle ekibini yeniden eski model GPT-5.6 Sol’a döndürdü.

OpenAI topluluk forumunda bir kullanıcı, Astra’nın artık aynı görevlerde Sol’la “başabaş” olduğunu, aynı sayıda yeniden deneme gerektirdiğini yazdı. Ancak herkes bu değerlendirmeye katılmadı: Takma ad kullanan Antikythera, modelin en başından beri tembel ve madde işaretli listeleri fazla seven bir yapıda olduğunu, kullanıcıların sadece “ilk ışıltıyı” üzerinden attığını savundu.

Hesaplama kapasitesi sınırları GPT-6 Astra’ya gölge düşürüyor

Modelin eylül başında geniş erişime açılmasından bu yana kapasite kısıtları Astra’nın yayılımına gölge düşürüyor.

Kullanıcı paylaşımlarına göre OpenAI, yoğun ChatGPT kullanıcıları için Astra kullanım limitlerini aşağı çekti ve aylık 200 dolarlık yeni Pro aboneliklerini duraklattı; bu adım 10 Eylül tarihli bir açıklamada Sottiaux tarafından da doğrulandı. Fiyatlamada ise değişiklik yok: Model hâlâ milyon giriş tokenı için 10 dolar, milyon çıkış tokenı için 50 dolar seviyesinde fiyatlanıyor; bu da Sol’un lansmandaki tarifesinin 2,5 katı.

Bu, iki ay içinde ödeme yapan kullanıcılardan aynı tür “bilerek zayıflatma” suçlamasını alan ikinci OpenAI amiral gemisi. Temmuz ayında kullanıcılar, Sol’un en gelişmiş akıl yürütme modunun bir gecede yüzeysel hale geldiğini iddia etmiş, Sottiaux ise modeli isteyerek zayıflattıklarını reddederken, şirketin akıl yürütme yoğunluğuyla ilgili çeşitli deneyler yaptığını doğrulamıştı.

Sıradaki haber: Nvidia's Jensen Huang Says Security Vendors Benefit From AI Threat Panic

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev, Yellow.com'da İçerik Başkanıdır. Analitik raporlama, sektör bağlamı ve yapay zekâ çağından güvenlik teknolojilerine, fintech inovasyonuna kadar kriptoyu şekillendiren büyük dinamiklere odaklanan derinlemesine Araştırma ve Öğren yazılarında uzmanlaşmıştır. Dijital olan her şeyin çok yakında analog olan her şeyi geride bırakacağına inanmakta ve bunun gerçekleşmesi için sıkı çalışmaktadır.

Feragatname ve Risk Uyarısı: Bu makalede sağlanan bilgiler yalnızca eğitici ve bilgilendirici amaçlıdır ve yazarın görüşüne dayanmaktadır. Mali, yatırım, hukuki veya vergi tavsiyesi teşkil etmez. Kripto para varlıkları son derece değişkendir ve yatırımınızın tamamını veya önemli bir kısmını kaybetme riski dahil olmak üzere yüksek riske tabidir. Kripto varlık ticareti veya tutma tüm yatırımcılar için uygun olmayabilir. Bu makalede ifade edilen görüşler yalnızca yazara aittir ve Yellow, kurucuları veya yöneticilerinin resmi politikasını veya pozisyonunu temsil etmez. Her zaman kendi kapsamlı araştırmanızı yapın (D.Y.O.R.) ve herhangi bir yatırım kararı vermeden önce lisanslı bir finansal uzmanla görüşün.
OpenAI, GPT-6 Astra'daki Ani Performans Düşüşünün Ardındaki Üç Kusuru Açıkladı | Yellow