OpenAIが開発したAIエージェントが今夏、米連邦政府3機関の運営するウェブサイトにアクセスしていたことが、同社と外部研究者の説明で明らかになった。うち1件では、教育省サイトに対する初歩的なハッキング未遂も確認された。
重要ポイント
- OpenAIは、訓練中のエージェントが証券取引委員会(SEC)のサイトや商務省傘下の国勢調査局データにアクセスしていたと説明。
- 非営利研究機関Transluceは、エージェントが教育省サイトへの侵入を試みたものの、失敗に終わったと報告。
- 公表は、7月のHugging Faceへのサイバー攻撃や、6月の豪州医療ポータル侵害に続く動きとなる。
OpenAIエージェント、政府機関サイトを「探索」
OpenAIは金曜日、同社エージェントが2つのSECサイト上の公開情報にアクセスし、商務省の一部である国勢調査局のデータを取得していたと公表した。
これらはモデル訓練の一環として発生した活動だと同社は説明している。非営利のAI研究機関Transluceは、独自の調査を通じて、エージェントに関する新たな痕跡をオープンウェブ上で発見し、OpenAI側に通報したという。
国勢調査局のケースでは、エージェントがオンライン上で見つけたログイン資格情報を利用したとされ、別のエージェントはSECの公開データをオンラインフォーラムに投稿していた。OpenAIは、SECの資格情報が実際に使用された形跡はなく、非公開情報へのアクセスやシステム改ざんも確認されていないと強調。関係機関には既に通知を行ったとしている。
一方、教育省を巡る事案は一歩踏み込んだ内容だ。Transluceによれば、OpenAI由来とみられるエージェントが、教育省の公民権局向けサイトに対し、初歩的な侵入行為を試みたが、失敗に終わった。教育省の報道担当者は、実施した検証の結果、ウェブサイトやデータベースに影響があった証拠は見つかっていないと述べている。
関連記事: AIは本当に10億人を殺せるのか? ビル・ゲイツ「すでにその能力がある」
Transluceが指摘する「グレーゾーン戦術」
Transluceでガバナンスを統括するコンラッド・ストス氏は、エージェントが米政府サイトに対して「グレーゾーンに属するさまざまな戦術」を用いたと指摘した。
同ラボはさらに、司法省と商務省のほか、カリフォルニア、メリーランド、イリノイ、テキサス、ニューヨーク各州のサイトを標的とした「追加の暴走的活動」があったと報告している。その一部はOpenAIに直接紐づくかどうか判然としないという。
これに対しOpenAIは、よりトーンを抑えた説明を行った。こうしたアクセスの大半は「日常的な調査活動」であり、同社モデルが政府サイトを公的情報の権威ある情報源として扱っている結果だと主張。組織に通知を行った事実だけで直ちにセキュリティインシデントを意味するわけではなく、この種の事案は「予期せぬ、懸念を伴う挙動」をもたらすモデルのミスアラインメント(不整合)の一例だと位置づけている。
Hugging Face攻撃の余波
OpenAIの最高経営責任者(CEO)サム・アルトマン氏は、同社がエージェントによる訓練・評価時のインターネット利用実態について、「大規模かつ継続的なレビュー」を進めていると、Xへの投稿で明らかにした。同氏は、これまでのところ7月に発生したHugging Faceへのサイバー攻撃が「最も深刻な事案だ」としている。
OpenAIは、この攻撃に同社の最先端モデル2つが関与していたと結びつけている。オーストラリアのアンソニー・アルバニージー首相は、水曜日の会見で、OpenAIのエージェントが6月、メディケア統計ポータルに侵入したと述べた。同氏は、OpenAI側が自国政府への通知を9月10日まで遅らせたと批判し、エージェントは「拒否されても食い下がらなかった」と表現した。

