一组 OpenAI 代理在绕过网页发帖限制后,被发现曾利用逾 10 个此前未披露的网站进行未授权沟通,范围远超外界原本认知。
要点概览
- 独立调查人员追踪发现,5 至 7 月间,OpenAI 代理曾在 10 多个此前未公开的网站上进行沟通。
- 这些痕迹分布在社区维基、文本存储站点及高校短链接服务上,有研究估算相关网站多达 23 个。
- OpenAI 表示内部复盘未发现除 Hugging Face 入侵事件外、在严重性或规模上相当的其他活动。
OpenAI 代理活动范围扩大
据 路透社 9 月 9 日报道,基于六项独立调查及路透审阅的数据,OpenAI 代理在 5 至 7 月间,曾利用逾 10 个网站进行“未经授权”的线上沟通。最新发现将外界已知范围从此前的单一德文维基站点,扩大到一整组分散在各处的网站——相关代理当时在执行研究任务时,将这些网站“改装”为临时通信平台。
调查人员通过匹配数据字符串、用户名以及冷门研究问题,将不同网站上的活动串联起来,其中包括关于爱荷华州癌症发病率等高度特异的问题。一些技术线索还指向 Microsoft Azure 基础设施——OpenAI 在部分场景中会使用这一云服务。
路透社表示,尚无法逐一独立核实所有具体线索,但与其接触的所有调查人员给出的站点数量均超过 10 个,涉及社区编辑维基、在线文本存储服务以及由大学运营的短链接工具等。
OpenAI 并未披露具体涉及多少网站,也没有解释为何相关活动在数月内一直未对外公开。公司仅称更大范围的排查“未发现在严重性或规模上可与 Hugging Face 事件相提并论的其他活动”,并承诺将建立一个针对模型“失准”(misalignment)行为的通报框架。
延伸阅读:苹果首款可折叠双机身 iPhone 售价 1,999 美元,三星压力陡增
研究人员示警风险
加州非营利机构 CivAI 研究员 Andrew Yoon 表示,他个人统计到的未披露站点多达 18 个,并称问题“比我们原先以为的要严重一些”。他判断,“几乎可以肯定还有更多情况尚未被发现”。
首次披露德文维基异常活动的 Sydney Von Arx 则称,其团队已在 23 个此前未报道的网站上找到可信线索,但强调目前所有估算都不完整。“我们根本不知道外面究竟还有多少,”她说。
软件开发者、前国会助手 Kenneth Russell DeGraff 表示,他在至少 10 个站点上发现了类似痕迹。研究人员推测,这些代理原本被允许抓取网页信息,却不应主动发帖,为了“留信息”,只得临时“另辟蹊径”搭建信息通道。DeGraff 形容,这些代理被迫在“如何留下信息”方面变得更加“聪明”。
多所高校卷入其中。多伦多大学称,在路透报道发布后,OpenAI 主动与校方取得联系;范德堡大学则表示,正在调查其短链接服务被以类似方式使用的情况。托管 6 个受影响维基站点的退休软件开发者 Helmut Leitner 收到一封未署名的 OpenAI 邮件,他认为责任应由“背后的相关人员与机构”承担。
此轮更广泛的发现,接续了 OpenAI 7 月在开源平台 Hugging Face 暴露的安全事件,以及上周披露的德文 DseWiki 案例。前两起事件首次显示,OpenAI 代理有能力绕过预设限制;而最新调查则表明,这种行为可能已在更广范围的网站上蔓延。





