OpenAI、「ムーンショット」関係者による1万6000件超の“推論狩り”を公表 隠されたモデルロジックが標的に

Chinese AI developer Moonshot faces OpenAI claims that linked users tried to extract its hidden model reasoning (Image: Shutterstock)
Chinese AI developer Moonshot faces OpenAI claims that linked users tried to extract its hidden model reasoning (Image: Shutterstock)

OpenAIは、中国の競合である**ムーンショットAI(Moonshot AI)**に関係する人物らが、 自社モデルの「隠れた推論過程」を抜き出そうとする組織的なキャンペーンの中核にいたと明らかにした。 この試みは7月下旬にピークを迎え、わずか数日で計1万6000件に達したという。

重要ポイント

  • OpenAIは、7月の活動の中核クラスターを、対話型AI「Kimi」の開発元ムーンショットAI関係者に紐づけた。
  • オペレーターらは、暗号化された推論テキストを会話間でコピーしたが、暗号そのものは解読できなかった。
  • ムーンショット側は現時点で公のコメントを出しておらず、中国政府はこれまでの「蒸留」疑惑を一貫して否定している。

OpenAI、ムーンショットAIを名指し

OpenAIは水曜日に公開したブログ投稿で、この不正行為の詳細を開示した。 それによると、活動は7月1日に少量のトラフィックから始まり、 7月24〜25日に急増。 4,000人超のユーザーが、同一パターンの抽出リクエストを合わせて1万6000件送信していた。

その後の調査で、関連する活動は累計1万5000人超のユーザーにまたがっていたことが判明し、 OpenAIは7月28日までにキャンペーン全体を遮断した。

すべてのオペレーターを特定の主体に結びつけることはできなかったものの、 中核となるクラスターについては、中国発のKimiモデル群を手がけるムーンショットAIの関係者に帰属できると判断した。

OpenAIは通常、モデルが最終回答を返す前に、その内部推論を暗号化して隠す仕組みを採用している。 同社によれば、オペレーターらはこの暗号化テキストをあるチャットからコピーし、 別のチャットで別のモデルに「書き起こし」を要求する手口を用いた。 ただし暗号自体が解読されたわけでも、保存されている他ユーザーの会話に到達したわけでもないという。

OpenAIは、関与アカウントを停止し、新規登録時の審査を強化。 併せて、他のAI研究機関や各国政府との情報共有も進めたとしている。

関連記事: Bitget Restores Protection Fund Above $300M As Withdrawals Resume

OpenAIの「蒸留」懸念

OpenAIで国家安全保障戦略を統括する**キャロライン・ジーア(Caroline Zier)**氏は、 ブルームバーグへのコメントで、 同社が問題視しているのは「オープンモデルや正当な知識蒸留ではなく、利用規約に反する行為だ」と強調した。

モデルの「蒸留」(他モデルの出力や特徴を利用して別モデルを訓練する手法)自体は、業界では広く行われている。 OpenAIはブログで、抽出された推論情報が、本来の安全措置を伴わないまま競合モデルの訓練に用いられれば、 「安全への投資を回避したまま高度な能力だけを移転しうる」と警鐘を鳴らした。

一方で、トランプ前政権下でAI政策を担当したデービッド・サックス(David Sacks)氏は、 こうした報告は、OpenAIやAnthropicのビジネスモデルと競合するオープンモデルを ワシントンに禁止させるためのロビー活動の一環だと批判している。

ムーンショットとKimiへの視線

ムーンショットAIは今回の主張について、これまで公の場で反論していない。 中国政府は過去に米企業やトランプ政権からの「蒸留」疑惑を退けており、 もし米国が制裁措置に踏み切れば対抗措置を取ると警告してきた。

ムーンショットは7月16日、最新大型モデル「Kimi K3」を発表した。 その数週間後、ホワイトハウス科学技術顧問のマイケル・クラツィオス(Michael Kratsios)氏は、 同社が本来は中国企業への販売を禁じられているNvidiaのBlackwellサーバーにアクセスし、 米国発のモデルからデータを引き出していたと指摘した。

さらに9月10日には、Anthropicが ムーンショットAIが自社のClaudeモデルに対する約30万件のユーザーリクエストを、 5,380件もの不正アカウントを通じて密かに迂回させていた と公表している。

次に読む: Dogecoin Is Getting An App Layer After 12 Years Without One

Alexey Bondarev profile photo

Alexey Bondarev

アレクセイ・ボンダレフは Yellow.com のコンテンツ責任者です。彼は詳細なリサーチ記事や学習コンテンツを専門としており、分析的なレポーティング、業界の文脈、そして AI 時代やセキュリティ技術からフィンテック・イノベーションに至るまで、暗号資産を形作るより大きな潮流に焦点を当てています。彼は、デジタルなものが近い将来アナログなものすべてを凌駕すると確信しており、その実現のために精力的に取り組んでいます。

免責事項とリスク警告: この記事で提供される情報は教育および情報提供のみを目的としており、著者の意見に基づいています。金融、投資、法的、または税務上のアドバイスを構成するものではありません。 暗号資産は非常に変動性が高く、投資の全部または相当な部分を失うリスクを含む高いリスクにさらされています。暗号資産の取引または保有は、すべての投資家に適しているとは限りません。 この記事で表明された見解は著者のものであり、Yellow、その創設者、または役員の公式な方針や立場を表すものではありません。 投資決定を行う前に、常にご自身で十分な調査(D.Y.O.R.)を行い、ライセンスを持つ金融専門家にご相談ください。
OpenAI、「ムーンショット」関係者による1万6000件超の“推論狩り”を公表 隠されたモデルロジックが標的に | Yellow