OpenAI、「GPT-6 Astra」品質低下の要因を3点特定し修正

Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)
Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)

OpenAIは、新モデルGPT-6 Astraについて「公開後に性能が落ちた」とする利用者からの苦情が相次いだ問題で、その要因となった3つの欠陥を修正し、Codex加入者向けの利用制限をリセットした。

主なポイント

  • Astra利用者は一週間にわたり、リリース直後の性能と現在の挙動を並べて検証し、「こっそり弱体化された」とX(旧Twitter)などで訴えていた。
  • OpenAIのCodex責任者は、約4,000〜5,000人が影響を受けた文脈管理の実験を含む3つの要因を挙げた。
  • 7月には、前世代の旗艦モデルGPT-5.6 Solに対しても同様の「ナーフ(弱体化)」疑惑が持ち上がっていた。

OpenAI、Astraの品質低下要因を修正

Codexのプロダクトリードを務める**ティボ・ソティオー(Tibo Sottiaux)**氏は、ユーザーと協力して不具合の原因を追跡し、土曜深夜(現地時間)までに修正と利用上限の全面リセットを実施したと、同氏のアップデートが公開された。

それによると、旧世代モデル向けに書かれたスキル(拡張機能)が過剰に発火し、Astra自身による検証プロセスを途中で止めてしまうケースがあったという。

さらに、オプション扱いの「文脈管理実験」が、回答を途中で打ち切らせたり、古いメッセージに反応させたりする原因となっていた。OpenAIは、この実験で影響を受けた約4,000〜5,000人のユーザーを確認し、機能を停止した。

また、一部の推論エンジンの設定ミスにより、そこに割り当てられた“端数トラフィック”の品質が有意に低下していたことも判明。OpenAIは問題のエンジンを除外し、複数のマイナー修正を加えた。ソティオー氏は、自身のX投稿で「ユーザーの最新メッセージをより正確に追跡できるようになった」と説明している。

関連記事: イーサリアム、ETF資金流入2.16億ドルでも2,800ドルに供給の壁

Astra利用者から「コード品質の後退」指摘

一週間にわたりX上では、開発者らがリリース当日のAstraと現在のAstraに同一プロンプトを投げ、設定も統一したうえで結果を比較する投稿が相次いだ。

かつてAstraを高く評価していた開発者の**プランジャル・パリワル(Pranjal Paliwal)**氏は、同モデルが生成したコードを改めて読み返した結果、「進歩ではなくむしろ後退だ」と手厳しく批評している。

コーディングツール「Opencode」を手がける**ダックス・ラード(Dax Raad)**氏は、Astraに移行したことでコストがほぼ倍増した一方、見合う改善が得られないとして、チームを再び旧モデルのGPT-5.6 Solへ戻した。

OpenAIの公式フォーラムでも、ある投稿者が指摘したように、「同じタスクを同じ回数リトライさせると、今のAstraはもはやSolと同レベルにとどまっている」との意見も出ている。

もっとも、この見方に異を唱える声も少なくない。ハンドルネームAntikytheraを名乗るユーザーは、「Astraは当初から“怠けがち”で箇条書きを好むモデルだった。利用者が単に“魔法”に慣れただけだ」として、性能低下説に懐疑的な立場を取った。

逼迫する計算資源、Astraを直撃

計算資源の制約は、GPT-6 Astraが9月初旬に広く開放されて以来、一貫して影を落としてきた。

ユーザー報告によれば、OpenAIはChatGPTのヘビーユーザー向けにAstraの利用上限を引き下げ、新規の月額200ドルのProサブスクリプション受付も一時停止している。こうした措置について、ソティオー氏は9月10日付の投稿で正式に認めた

料金面では、Astraは依然として入力トークン100万件あたり10ドル、出力トークン100万件あたり50ドルに据え置かれている。これは、GPT-5.6 Solのローンチ時と比べて2.5倍の水準だ。

なお、OpenAIの旗艦モデルがユーザーから「ナーフされた」と訴えられるのは、この2カ月で2度目となる。7月には、Solの最上位「推論強化モード」が一夜にして浅くなったとの声が上がり、ソティオー氏は「意図的な弱体化」を否定しつつも、推論負荷に関する実験を行っていたことは認めていた。

関連記事: Nvidiaのジェンスン・フアン氏「AI脅威論で最も得をするのはセキュリティ企業」

Alexey Bondarev profile photo

Alexey Bondarev

アレクセイ・ボンダレフは Yellow.com のコンテンツ責任者であり、過去 10 年間にわたって暗号資産分野を取材してきました。彼は、分析的な報道、業界コンテクスト、そして AI 時代やセキュリティ技術からフィンテック・イノベーションに至るまで、暗号資産を形作るより大きな力に焦点を当てた、詳細なリサーチ記事やラーニング記事を専門としています。彼は「デジタルなものがアナログなものを間もなくすべて凌駕する」と信じており、その実現のために日々努力を続けています。

免責事項とリスク警告: この記事で提供される情報は教育および情報提供のみを目的としており、著者の意見に基づいています。金融、投資、法的、または税務上のアドバイスを構成するものではありません。 暗号資産は非常に変動性が高く、投資の全部または相当な部分を失うリスクを含む高いリスクにさらされています。暗号資産の取引または保有は、すべての投資家に適しているとは限りません。 この記事で表明された見解は著者のものであり、Yellow、その創設者、または役員の公式な方針や立場を表すものではありません。 投資決定を行う前に、常にご自身で十分な調査(D.Y.O.R.)を行い、ライセンスを持つ金融専門家にご相談ください。
OpenAI、「GPT-6 Astra」品質低下の要因を3点特定し修正 | Yellow