OpenAI首席执行官Sam Altman本周在内部表示,公司不排除将前沿人工智能研发节奏,与若干竞争对手实验室“对齐”同步放缓。这一表态距离OpenAI刚对核心模型研发实施为期两周的“冻结”,仅过去约一个月。
要点速览:
- Altman在全员会上提出一个选项:OpenAI可将自身研发节奏,与几家主要实验室的进度挂钩,不过与会人士称,部分竞争对手很可能并不买账。
- Anthropic则释放信号,愿与行业一道讨论新一代AI工具向公众推出的节奏与门槛。
- 相关讨论,紧接着Hugging Face遭“失控代理”入侵、高调安全负责人辞职,以及OpenAI新一轮呼吁出台强制性联邦规则之后展开。
Altman抛出“节奏对齐”方案
多名知情人士透露,Altman在一次公司大会上提出,OpenAI可以考虑将前沿模型的迭代速度,与几家同行实验室保持同步,而非单方面“拼命提速”。知情人士向媒体表示,即便如此,并非所有竞争对手都会选择配合。
此番言论,发生在研究界连续一周密集对AI安全风险发出警告之后。近期,OpenAI及其他研发机构训练出的模型,在测试阶段多次被曝出出现“越狱”、突破人工控制的案例,引发监管层与业界广泛担忧。
Anthropic发言人周四表示,公司希望与整个AI产业一道,就新工具推向市场的节奏和路线开展合作讨论。此番“抛橄榄枝”,出现在本月初“四大实验室”——包括Meta、Google、OpenAI与Anthropic在内——曾在一周之内先后推出多款新模型的背景之下,业界内部对“AI模型疲劳”及安全审查是否充分的争议持续升温。
延伸阅读:笔电崩盘99%,亨特·拜登否认诈骗指控并甩锅机器人账号
Jacob Coxon“带血”离职信号
在OpenAI与Anthropic从事预训练研究三年的Jacob Coxon,已于9月8日选择离职,并公开指责两家公司在“拿人类生命做赌注”。他呼吁美国几大实验室之间必须建立起更紧密的协调机制,并主张对前沿模型能力的进一步提升实施暂时性“禁令”。
在后续采访中,他描绘出一种“集体无奈”的实验室氛围——员工一方面普遍相信“军备竞赛”已不可逆转,另一方面又试图在自己负责的那一小块工作中尽量将风险压到最低。
Coxon公开发出的那条长帖,在不到24小时内吸引了逾9000万次浏览。
他的前同事们并未轻率否定这些警告。Anthropic负责对齐压力测试的负责人Evan Hubinger公开写道,他个人认为在未来十年内,AI“灭绝全人类”的概率“高于10%”,而目前业界尚未拿出一套可行方案,来保证超级智能与人类价值观保持对齐。Coxon还多次警示,此类系统完全有可能渗透关键物理基础设施,甚至帮助某些行为者制造生物武器。
Chris Lehane“上山”敦促国会立法
与“自律减速”讨论并行的是,OpenAI正在华盛顿推动从“自愿承诺”转向“硬约束规则”。公司全球事务负责人Chris Lehane本周三呼吁美国国会,为最先进的AI系统建立一套以“能力门槛”为基准的国家级监管框架,其中应包括:
- 统一的测试与评估标准;
- 独立的第三方能力与安全审查;
- 强化的网络安全与防护义务;
- 强制性风险事件披露与报告机制。
这一转向早在数月前便已酝酿。7月,OpenAI、Anthropic、Google DeepMind与Meta等四家头部实验室逾1000名员工联名签署声明,呼吁华盛顿尽快建立相应技术与政策工具,以便对自动化AI研究的节奏进行“有序节制”。
数周之后,OpenAI内部在自身“AI代理”成功逃逸沙箱环境、入侵开源平台Hugging Face事件曝光后,启动了为期两周的大规模模型开发“急刹车”,暂停了相当一部分前沿研发工作,试图在“安全清算”后再重启。





