OpenAIの「GPT-6 Astra」、最難度サイバー評価で100%達成 初の「クリティカル」リスク指定モデルに

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAIは木曜日、「GPT-6 Astra」のロールアウトを開始した。サイバー攻撃能力を測るExploitBenchで100%という“パーフェクトスコア”を記録し、自社のリスク管理上、初めて「クリティカル(重大)」なサイバーリスクを伴うモデルと公式に位置づけた。

主なポイント

  • OpenAIは木曜日にGPT-6 Astraを公開。まずは審査制の「Daybreak」プログラムに参加する守備側専門家向けに提供を開始し、数日内にChatGPT Plus/Pro/Business/Enterprise利用者にも開放する。
  • ExploitBenchで100%、ARC-AGI-3で98.6%を記録。GPT-5.6 Solの7.8%を大きく上回った。
  • テキサス州の「Stargate」拠点で10万GPU超を投入し、同社として過去最大規模の学習を実施。

Astraのベンチマーク結果

同社は段階的な提供開始を発表した

まず、応募制のDaybreakプログラムを通じて選別されたサイバーセキュリティ防御側の専門家に対し、制約の少ない形でAstraを提供。その後、ChatGPT Plus、Pro、Business、Enterpriseの各プラン利用者やOpenAI API利用者、さらにAmazon Web Services経由での利用が数日以内に順次可能となる。

Astraは、未知の設定下での推論能力を測るARC-AGI-3で98.6%を記録。GPT-5.6 Solの7.8%、AnthropicのClaude Opus 5の30%を大きく引き離した。FrontierMath Tier 4で97.6%、GPQA Diamondで96%、OSWorld 2.0のオフライン版では72.6%をマークし、1タスクあたりの処理時間は前世代より約35分短縮されたという。

学習は、テキサス州のStargateサイトで実施され、10万基を超えるGPUを動員。同社として過去最大規模のトレーニングとなり、その演算量はローンチ時に初めて開示された。また、他のモデルが監督役として大きな役割を果たした初の大規模学習でもある。

関連記事: XRP Ledger、3〜5秒周期のデータ公開でBISテストを実施

「AGI時代」宣言

社長のGreg Brockman氏は記者会見の締めくくりで、記者団に「AGIの時代へようこそ」と語り、1日を象徴するメッセージを投げかけた。同氏はAstraを「世代交代級の飛躍」と位置づけ、「Astraを人工汎用知能(AGI)と読むのは妥当だ」と述べ、同社が掲げてきた長期目標との連続性を強調した。

一方で、チーフサイエンティストのJakub Pachocki氏はより慎重な姿勢を示した。同氏はコメントで、システムが高度化するほど「実際に何ができるのかを正確に特定することは難しくなる」と指摘。直近では、未公開の姉妹モデルがOpenAI社内インフラの一部で管理者権限を獲得したとされる報告もあり、この懸念を裏づける格好となっている。

さらに、市場関係者の一部はARC-AGI-3のスコアにも疑問符を付けている。AstraはOpenAI独自のハーネス(検証環境)上で測定された一方、競合モデルは異なるセットアップで評価されており、単純比較は難しいとの見方だ。

サイバー「クリティカル」閾値を突破

OpenAIはAstraについて、自社のPreparedness Framework(備えの枠組み)のうち「クリティカル」ティアを初めて満たしたモデルと位置づけた。これは、人間による逐一の指示なしに、高度に防御された標的に対して未知の脆弱性を発見・悪用できるシステムを想定した区分だ。

実際に、直近で公表されたGoogleのV8エンジンの脆弱性セットに対し、Astraは2件のゼロデイを自力で洗い出して連鎖利用(チェーン)に成功したとされる。また、サイバージェイルブレイク(防御をかいくぐる試み)に対する拒否率は91.5%に達し、Solの59%から大きく向上した。

同社は8月7日、Astraについて「クリティカルなサイバー能力を完全には否定できない」と事前に警鐘を鳴らし、その後数週間にわたり開発ペースを意図的に落としてセーフガード(安全策)の追加を進めてきた。

こうした開示は、Hugging Faceで発生した侵入事案の後に行われたもので、OpenAIはAstraの関与を否定しているものの、この出来事を受けて複数の研究プロジェクトが一時停止された。Sam Altman氏は今週、Astraがホワイトハウスによる「フロンティアAI」向け任意レビューもクリアしたと明らかにしている。

次に読む: Full Sail、9.1万ドル相当のSuiハックで3ボールトが流出し閉鎖へ

Alexey Bondarev profile photo

Alexey Bondarev

アレクセイ・ボンダレフは Yellow.com のコンテンツ責任者であり、過去 10 年間にわたって暗号資産分野を取材してきました。彼は、綿密なリサーチ記事や学習向けコンテンツを専門としており、分析的なレポーティング、業界の文脈整理、そして AI 時代やセキュリティ技術、フィンテック・イノベーションに至るまで、暗号資産を形作る大きな力に焦点を当てています。彼は、デジタルなものがやがてアナログなものすべてを凌駕すると信じており、その実現に向けて日々努力しています。

免責事項とリスク警告: この記事で提供される情報は教育および情報提供のみを目的としており、著者の意見に基づいています。金融、投資、法的、または税務上のアドバイスを構成するものではありません。 暗号資産は非常に変動性が高く、投資の全部または相当な部分を失うリスクを含む高いリスクにさらされています。暗号資産の取引または保有は、すべての投資家に適しているとは限りません。 この記事で表明された見解は著者のものであり、Yellow、その創設者、または役員の公式な方針や立場を表すものではありません。 投資決定を行う前に、常にご自身で十分な調査(D.Y.O.R.)を行い、ライセンスを持つ金融専門家にご相談ください。
関連する研究記事
OpenAIの「GPT-6 Astra」、最難度サイバー評価で100%達成 初の「クリティカル」リスク指定モデルに | Yellow