OpenAI 已經修正外界一週來抱怨不斷的三項缺陷,這些問題被指是新模型 GPT-6 Astra 上線後「越用越笨」的主因, 同時也替 Codex 訂閱戶重置使用額度。
重點整理:
- Astra 用戶一整週在網路上貼出對照測試,指稱模型自上線後「悄悄被削弱」。
- OpenAI Codex 負責人點名三大原因,其中一項為影響約 4,000 至 5,000 名用戶的情境實驗。
- 前一代旗艦模型 GPT-5.6 Sol 今年 7 月也曾遭遇相同質疑。
OpenAI 修補 Astra 品質瑕疵
Codex 產品負責人 Tibo Sottiaux 表示,團隊與用戶合作追蹤問題來源,完成修補後, 並在當地時間週六午夜前推出更新與全面用量重置,相關說明已於 公告 中公開。
他指出,為舊版模型撰寫的「技能」在 Astra 上觸發頻率過高,有時反而阻礙模型自行檢查與修正輸出結果。
另一項可選的「情境管理」實驗,也可能導致模型過早終止回覆,或是對舊訊息作答。 OpenAI 在發現該實驗影響約 4,000 至 5,000 名用戶後,已全面關閉這項測試。
此外,部分後端引擎設定錯誤,導致導流至這些引擎的「尾端流量」品質明顯下滑。 公司已將相關引擎下線,並針對系統做出多項微調。Sottiaux 在 貼文 中強調,模型現在能更精準聚焦在用戶「最後一則訊息」。
延伸閱讀: 以太幣在 2,800 美元面臨籌碼壓力,ETF 淨流入飆至 2.16 億美元
Astra 用戶抱怨「寫程式退步」
一週來,X 平台上充斥開發者的實測貼文。許多開發者將 Astra 上線當天版本與目前版本進行「同題對照」, 保持所有設定完全一致,再比較 輸出差異。
先前才公開稱讚 Astra 的開發者 Pranjal Paliwal,事後回頭仔細檢視 Astra 為他產出的程式碼, 最終認定品質出現的是「退化」而非進步。
開發工具 Opencode 創辦人 Dax Raad 則表示,團隊在 Astra 上的花費幾乎翻倍, 但實際效益卻不如預期,因此決定暫時退回使用舊款 GPT-5.6 Sol。
有論壇用戶在 貼文中表示, 現在的 Astra 在相同任務、相同重試次數下,表現已經「降到跟 Sol 差不多」。 不過也有人持相反看法,一名化名 Antikythera 的用戶認為,Astra 從一開始就偏向「偷懶」、 愛用條列式回答,只是用戶不再被新鮮感「蒙蔽」。
計算資源天花板籠罩 GPT-6 Astra
計算與容量問題,自 GPT-6 Astra 9 月初擴大開放以來就如影隨形。
多名用戶回報,OpenAI 已下調重度 ChatGPT 用戶可用的 Astra 配額, 並暫停接受新申請的 200 美元 Pro 訂閱方案;上述措施已獲 Sottiaux 在 9 月 10 日接受 訪談 時證實。
定價方面,Astra 仍維持每百萬輸入 Token 收費 10 美元、每百萬輸出 Token 收費 50 美元, 約為 Sol 上線時定價的 2.5 倍,顯示 OpenAI 仍將其定位為高階旗艦產品。
這已是兩個月內第二次有 OpenAI 旗艦模型遭付費用戶指控「被動刀」。 今年 7 月,部分用戶表示 Sol 的最高階推理模式「一夜之間變得很淺」。 Sottiaux 當時否認公司刻意削弱模型,但承認內部確實在測試不同的「推理強度」參數。

