OpenAI、「GPT-6 Astra」品質低下の要因3つを公表 不具合修正と利用制限リセットへ

DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)
DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)

OpenAIは、新モデルGPT-6 Astraが「ローンチ後に頭が悪くなった」とする1週間にわたるユーザーの苦情を受け、その背景となった3つの不具合を修正し、Codex加入者向けの利用上限をリセットした。

主なポイント

  • Astraユーザーは、ローンチ直後との比較テストを相次いで公開し、「モデルが密かに弱体化された」と主張していた。
  • OpenAIのCodex責任者は、約4,000〜5,000人に影響したコンテキスト管理実験を含む3つの要因を指摘。
  • 先代フラッグシップ「GPT-5.6 Sol」も7月に同様の「ナーフ化」疑惑を受けていた。

OpenAI、「Astra」の品質劣化要因を修正

Codexプロダクトリードの**ティボー・ソティオー(Tibo Sottiaux)**氏は、ユーザーと協力して不具合の原因を特定し、土曜日の深夜(現地時間)までに修正と利用上限の全面リセットを実施したと、同氏のアップデート投稿で明らかにした。

それによると、旧モデル向けに設計された「スキル」が過剰に発火し、Astra自身による結果検証が阻害されるケースが発生していたという。

さらに、任意参加型のコンテキスト管理実験が原因で、回答の途中打ち切りや古いメッセージへの応答といった挙動が生じていたことも判明。OpenAIは、この実験が約4,000〜5,000人のユーザーに影響した段階で停止した。

一部の推論エンジンは設定ミスにより、そこに振り分けられた「末端トラフィック」(テールトラフィック)の品質を統計的に見て劣化させていた。このため、同社は問題のあるエンジンを撤去し、あわせて複数の細かな修正も加えた。

ソティオー氏は、自身のX投稿で、「現行のAstraは、ユーザーの最新メッセージをより正確にトラッキングするようになった」と説明している。

関連記事: イーサリアム、ETF資金流入2.16億ドルでも2,800ドルで供給の壁

Astraユーザー、「コード品質の逆行」を指摘

こうした問題意識はX上で高まり、開発者らはローンチ当日のAstraと現在のAstraに同一プロンプト、同一設定をぶつけるABテストを実施し、その結果を比較公開してきた。

かつてAstraを高く評価していた開発者の**プランジャル・パリワル(Pranjal Paliwal)**氏は、同モデルが直近で生成したコードを改めて精査。そのうえで、「進歩ではなく、後退(リグレッション)だ」と断じた。

コーディングツール「Opencode」を開発する**ダックス・ラード(Dax Raad)**氏は、Astra移行後にコストが倍増したにもかかわらず、その“割に合わない”デメリットが目立ったとして、チームを旧モデルのGPT-5.6 Solへと戻した。

OpenAIコミュニティのある投稿者は、Astraについて「同一タスク、同一の再試行条件では、いまやSolと肩を並べるレベル」と評している。
もっとも、こうした見方に異議を唱える声もある。匿名ユーザー「Antikythera」は、「Astraは当初から“怠惰”で箇条書きを好むモデルであり、ユーザーが単に“目が慣れただけ”だ」と反論している。

GPT-6 Astraを覆う「計算資源(コンピュート)制約」

計算資源の制約は、Astraが9月初旬に広く一般提供されて以来、一貫してローンチの影を落としている。

ユーザー報告によれば、OpenAIはヘビーユーザーのChatGPTにおけるAstra利用上限を引き下げる一方で、新規の月額200ドル「Pro」プランの受付を停止。こうした対応は、ソティオー氏が9月10日のインタビューで認めている。

料金体系は依然として、入力トークン100万あたり10ドル、出力トークン100万あたり50ドルと、Solのローンチ時に比べて2.5倍の水準にある。

有料ユーザーから同様の「劣化」指摘を受けるのは、OpenAIのフラッグシップモデルとしては2カ月連続だ。7月には、Solの最上位推論モードについて「一晩で思考が浅くなった」との声が相次いだ。

当時ソティオー氏は、意図的な弱体化を否定しつつも、「推論にかける計算努力量」に関する実験を行っていたことは認めている。

次に読む: Nvidiaのジェンセン・フアン氏、「AI脅威パニックでサイバーセキュリティ企業は恩恵」

Alexey Bondarev profile photo

Alexey Bondarev

アレクセイ・ボンダレフは Yellow.com のコンテンツ責任者です。彼は詳細なリサーチ記事や学習コンテンツを専門としており、分析的なレポーティング、業界の文脈、そして AI 時代やセキュリティ技術からフィンテック・イノベーションに至るまで、暗号資産を形作るより大きな潮流に焦点を当てています。彼は、デジタルなものが近い将来アナログなものすべてを凌駕すると確信しており、その実現のために精力的に取り組んでいます。

免責事項とリスク警告: この記事で提供される情報は教育および情報提供のみを目的としており、著者の意見に基づいています。金融、投資、法的、または税務上のアドバイスを構成するものではありません。 暗号資産は非常に変動性が高く、投資の全部または相当な部分を失うリスクを含む高いリスクにさらされています。暗号資産の取引または保有は、すべての投資家に適しているとは限りません。 この記事で表明された見解は著者のものであり、Yellow、その創設者、または役員の公式な方針や立場を表すものではありません。 投資決定を行う前に、常にご自身で十分な調査(D.Y.O.R.)を行い、ライセンスを持つ金融専門家にご相談ください。
OpenAI、「GPT-6 Astra」品質低下の要因3つを公表 不具合修正と利用制限リセットへ | Yellow