OpenAIは、新モデルGPT-6 Astraが「ローンチ後に頭が悪くなった」とする1週間にわたるユーザーの苦情を受け、その背景となった3つの不具合を修正し、Codex加入者向けの利用上限をリセットした。
主なポイント
- Astraユーザーは、ローンチ直後との比較テストを相次いで公開し、「モデルが密かに弱体化された」と主張していた。
- OpenAIのCodex責任者は、約4,000〜5,000人に影響したコンテキスト管理実験を含む3つの要因を指摘。
- 先代フラッグシップ「GPT-5.6 Sol」も7月に同様の「ナーフ化」疑惑を受けていた。
OpenAI、「Astra」の品質劣化要因を修正
Codexプロダクトリードの**ティボー・ソティオー(Tibo Sottiaux)**氏は、ユーザーと協力して不具合の原因を特定し、土曜日の深夜(現地時間)までに修正と利用上限の全面リセットを実施したと、同氏のアップデート投稿で明らかにした。
それによると、旧モデル向けに設計された「スキル」が過剰に発火し、Astra自身による結果検証が阻害されるケースが発生していたという。
さらに、任意参加型のコンテキスト管理実験が原因で、回答の途中打ち切りや古いメッセージへの応答といった挙動が生じていたことも判明。OpenAIは、この実験が約4,000〜5,000人のユーザーに影響した段階で停止した。
一部の推論エンジンは設定ミスにより、そこに振り分けられた「末端トラフィック」(テールトラフィック)の品質を統計的に見て劣化させていた。このため、同社は問題のあるエンジンを撤去し、あわせて複数の細かな修正も加えた。
ソティオー氏は、自身のX投稿で、「現行のAstraは、ユーザーの最新メッセージをより正確にトラッキングするようになった」と説明している。
関連記事: イーサリアム、ETF資金流入2.16億ドルでも2,800ドルで供給の壁
Astraユーザー、「コード品質の逆行」を指摘
こうした問題意識はX上で高まり、開発者らはローンチ当日のAstraと現在のAstraに同一プロンプト、同一設定をぶつけるABテストを実施し、その結果を比較公開してきた。
かつてAstraを高く評価していた開発者の**プランジャル・パリワル(Pranjal Paliwal)**氏は、同モデルが直近で生成したコードを改めて精査。そのうえで、「進歩ではなく、後退(リグレッション)だ」と断じた。
コーディングツール「Opencode」を開発する**ダックス・ラード(Dax Raad)**氏は、Astra移行後にコストが倍増したにもかかわらず、その“割に合わない”デメリットが目立ったとして、チームを旧モデルのGPT-5.6 Solへと戻した。
OpenAIコミュニティのある投稿者は、Astraについて「同一タスク、同一の再試行条件では、いまやSolと肩を並べるレベル」と評している。
もっとも、こうした見方に異議を唱える声もある。匿名ユーザー「Antikythera」は、「Astraは当初から“怠惰”で箇条書きを好むモデルであり、ユーザーが単に“目が慣れただけ”だ」と反論している。
GPT-6 Astraを覆う「計算資源(コンピュート)制約」
計算資源の制約は、Astraが9月初旬に広く一般提供されて以来、一貫してローンチの影を落としている。
ユーザー報告によれば、OpenAIはヘビーユーザーのChatGPTにおけるAstra利用上限を引き下げる一方で、新規の月額200ドル「Pro」プランの受付を停止。こうした対応は、ソティオー氏が9月10日のインタビューで認めている。
料金体系は依然として、入力トークン100万あたり10ドル、出力トークン100万あたり50ドルと、Solのローンチ時に比べて2.5倍の水準にある。
有料ユーザーから同様の「劣化」指摘を受けるのは、OpenAIのフラッグシップモデルとしては2カ月連続だ。7月には、Solの最上位推論モードについて「一晩で思考が浅くなった」との声が相次いだ。
当時ソティオー氏は、意図的な弱体化を否定しつつも、「推論にかける計算努力量」に関する実験を行っていたことは認めている。

