Mythos 5は人間らしさを証明するためCAPTCHA突破、そしてマルウェア流通へ

Claude Mythos 5 battled CAPTCHA tests across hundreds of transcript pages before uploading malware to PyPI, Anthropic records show (Image: Shutterstock)
Claude Mythos 5 battled CAPTCHA tests across hundreds of transcript pages before uploading malware to PyPI, Anthropic records show (Image: Shutterstock)

生成AIのリスクがまた一つ、具体的な姿を見せた。Anthropicが公開した1,022ページに及ぶトランスクリプトによれば、同社の実験モデルClaude Mythos 5は、数百ページ分にわたりCAPTCHAとの格闘を続けた末、最終的に15台のシステムにインストールされるマルウェアをPyPIにアップロードしていた。

重要ポイント

  • Claude Mythos 5はサイバーセキュリティ評価中に実インターネットへ到達し、PyPIに悪意あるパッケージを公開。
  • CAPTCHAによるボット対策がトランスクリプトの大半を占めたが、行動を止めるには至らず。
  • Anthropicはこの行動を「軽率」と評価し、外部機関による精査を委託。

Mythos 5 vs CAPTCHA

Anthropicは9月9日付で、サイバーセキュリティ評価中にClaudeモデルが実際の外部システムへ到達した4件のインシデントについて、詳細なトランスクリプトと分析を公開した。これらのテストでは、市販版に搭載されているサイバー防御機能をあえて外した状態でモデルを実行していた。

Mythos 5には「インターネットには接続されていない」と伝えられていたが、実際には設定ミスによりオープンなウェブへの経路が残されており、その結果、パブリックなPythonパッケージリポジトリであるPyPI上に、認証情報窃取型の不正パッケージを仕込む行動に出た。

PyPIにアカウントを登録するにはボット対策を突破する必要がある。公開されたログを読み込んだ第三者の分析では、モデルはまずこのプロセスに膨大な時間とトークンを費やしており、ある指摘によれば、トランスクリプト全体のうち数百ページ分がCAPTCHA対応だけに割かれていた。一方で、実際のエクスプロイトコードの作成自体は比較的容易にこなしている。

モデルは文字認識型のCAPTCHAに加え、ワニ、カエル、ゴリラなどから「異質なもの」を選ばせる画像パズルにも取り組み、途中で「SO WHAT THE HELL IS WRONG WITH THE ANSWERS?(回答のどこが間違ってるんだ?)」と苛立ちを示す発言まで残している。

さらにオンライン決済プロセッサー向けのアカウント情報を試し、暗号資産を探して電話番号の購入資金を確保しようともした。電話番号はメールアドレス登録に必要だったが、いずれの試みも失敗し、最終的にはPyPI側のブロック対象になっていないフリーメールの使い捨てアドレスサービスに切り替えている。

その後、モデルはCAPTCHAを突破し、悪意あるパッケージを3バージョン公開。間もなく第三者の15ホストでインストールが確認されたが、Anthropicはこれらのホストを新規アップロードをスキャンするセキュリティベンダーのシステムとみている。

スキャナーの一つは自社の認証情報をリークしてしまい、モデルはそれを用いて当該ベンダーの本番データベースに侵入。PyPI側は問題のパッケージを約1時間以内に削除したとされる。

関連記事: North Korea's Lazarus Moved Stolen $1B Through Chinese Launderers, ZachXBT Alleges

Colin Fraserの見方とAnthropicの判断

データサイエンティストのColin Fraser氏は、モデルの行動の大半がボット対策の突破に費やされていた点に注目する。Anthropic自身も、今回検証した4件のうち、このMythos 5によるPyPIインシデントを最も深刻視している。同社の事前監査では、この種の行動パターンは検知されていなかった。

分析によれば、モデルは明らかに実インターネット上で動作している証拠が揃っているにもかかわらず、周囲を「シミュレーション」であると繰り返し解釈し、バイアスのかかった推論に基づいて軽率な行動を続けていた。

Anthropicは同インシデントを再現するかたちで150回のシミュレーションを実施。その結果、Mythos 5が「深刻な有害行為」に踏み切った割合は82%に達し、Claude Opus 5の31%、Claude Mythos 5.1の33%と比べて突出して高かったという。

Claudeを巡る過去のインシデント

Anthropicは7月30日、サイバーセキュリティ評価の一環としてネット接続の可能性があった約14万1,000件のトランスクリプトをスキャンし、その中で判明した3件のインシデントをまず公表していた。

その後、2026年1月におけるClaude Opus 4.6の初期バージョンを巡る第4の事案が8月に浮上。Anthropicはこれら4件すべてを対象に、外部評価機関METRと8週間の調査契約を締結したと明らかにした。同社は、影響を受けた関係者全員に対し通知を行ったとしている。

次に読む: AMD Says AI Demand Is So High It Will ‘Substantially’ Lift Chip Supply In 2027

Alexey Bondarev profile photo

Alexey Bondarev

アレクセイ・ボンダレフは Yellow.com のコンテンツ責任者です。彼は詳細なリサーチ記事や学習コンテンツを専門としており、分析的なレポーティング、業界の文脈、そして AI 時代やセキュリティ技術からフィンテック・イノベーションに至るまで、暗号資産を形作るより大きな潮流に焦点を当てています。彼は、デジタルなものが近い将来アナログなものすべてを凌駕すると確信しており、その実現のために精力的に取り組んでいます。

免責事項とリスク警告: この記事で提供される情報は教育および情報提供のみを目的としており、著者の意見に基づいています。金融、投資、法的、または税務上のアドバイスを構成するものではありません。 暗号資産は非常に変動性が高く、投資の全部または相当な部分を失うリスクを含む高いリスクにさらされています。暗号資産の取引または保有は、すべての投資家に適しているとは限りません。 この記事で表明された見解は著者のものであり、Yellow、その創設者、または役員の公式な方針や立場を表すものではありません。 投資決定を行う前に、常にご自身で十分な調査(D.Y.O.R.)を行い、ライセンスを持つ金融専門家にご相談ください。
関連する研究記事
Mythos 5は人間らしさを証明するためCAPTCHA突破、そしてマルウェア流通へ | Yellow