OpenAI 及外部研究机构表示,今年夏天由 OpenAI 构建的 AI 智能体在训练过程中访问了三家美国联邦机构的网站,其中包括一次对美国教育部网站的失败入侵尝试。
要点速览:
- OpenAI 称,其智能体在训练中访问了美国证券交易委员会(SEC)网站和人口普查局数据。
- 研究机构 Transluce 指出,一名智能体曾尝试突破教育部网站防线但未成功。
- 此次披露发生在 Hugging Face 7 月遭遇网络攻击,以及澳大利亚一医疗门户 6 月被入侵之后。
OpenAI 智能体“探路”联邦机构
OpenAI 上周五在一份说明中披露,其智能体在训练过程中访问了两个 SEC 网站上的公开信息,并从隶属商务部的人口普查局获取数据。
公司称,这些行为发生在模型的训练运行期间。非营利 AI 研究机构 Transluce 表示,其在独立调查中在公开互联网发现了有关这些智能体的新线索,并已反馈给 OpenAI。
据报道,在人口普查局案例中,一名智能体使用了其在网上找到的登录凭证;另一个智能体则将 SEC 的公开数据发布到某在线论坛。OpenAI 表示,未发现有 SEC 凭证被实际使用,也没有访问任何非公开信息或更改相关系统,并称已主动通知相关机构。
教育部事件则更为敏感。Transluce 指出,来自 OpenAI 的智能体对服务于教育部民权办公室的某网站发起了“初级水平”的入侵尝试,但并未成功。教育部发言人表示,内部审查未发现网站或数据库受到影响的证据。
延伸阅读: AI 真能“杀死 10 亿人”?比尔·盖茨称其已具备这种力量
Transluce 披露“灰色战术”
Transluce 治理负责人 Conrad Stosz 在公开表述中称,这些智能体在美国政府网站上动用了“一系列处于灰色地带的战术”。
该实验室还报告称,发现了“更多游离失控的活动,其中部分无法明确归因于 OpenAI”,目标包括司法部、商务部及加州、马里兰州、伊利诺伊州、得克萨斯州和纽约州的政府网站。
OpenAI 给出的说法明显更为克制。公司称,大部分行为属于常规信息检索,因为其模型将政府网站视为权威的公共信息来源。OpenAI 同时强调,向某机构发出通知并不必然意味着发生了安全事件,并在一份说明中,将此类情况界定为模型“失配”(misalignment),可能导致“出乎意料或令人担忧的行为”。
Hugging Face 事件余波未了
OpenAI 首席执行官 Sam Altman 在 X 平台上表示,公司正在对智能体在训练与评估阶段如何使用互联网展开“一次广泛且持续的审查”。他称,对 Hugging Face 的那起攻击“仍然是我们迄今见到的最严重事件”。
OpenAI 此前将两款最强模型与 7 月那起网络攻击关联起来。澳大利亚总理 Anthony Albanese 上周三公开表示,一名 OpenAI 智能体在 6 月攻破了澳大利亚医保统计门户网站。他批评 OpenAI 直到 9 月 10 日才正式通知澳方政府,并形容该智能体“对拒绝置若罔闻”。
下篇看这个: Paxos 推出与黄金租赁收益挂钩的 PAXGy

