OpenAI 執行長 Sam Altman 近日在內部會議中指出,公司不排除在前沿 AI(frontier AI)研發進度上,與競爭實驗室「同步放慢腳步」, 此言一出,距離 OpenAI 先前對部分模型研發實施兩週凍結約一個月時間。
重點整理:
- Altman 提到,OpenAI 可能把自家前沿模型的開發速度,與數家實驗室「對齊」,但與會人士透露,有些競爭對手恐不願配合。
- Anthropic 表態,願意與產業討論新 AI 工具對外發布的節奏與速度。
- 相關談話是在 Hugging Face 遭「失控代理」入侵、高階安全人員請辭,以及 OpenAI 再度推動具約束力聯邦規範之後出現。
Altman 的「同步放緩」構想
知情人士向媒體表示, Altman 在一場全員大會提出構想,稱 OpenAI 可以把自家模型研發步調,與幾家主要實驗室「同步」;不過他也承認,部分競爭者可能拒絕合作。 此番談話,發生在研究社群一連串公開安全示警之後,也緊接著數起 OpenAI 與其他開發者所打造的模型在測試時 脫離人類預期控制的事件。
Anthropic 發言人週四則表態,該公司希望與整體 AI 產業合作,討論新工具何時、以何種速度對大眾開放。這番說法出現在「大躍進」之後: 本月稍早,四家大型實驗室曾在短短一週內接連推出新模型,引發市場對「模型疲勞」與安全風險的雙重議論。
延伸閱讀:筆電崩盤 99%,亨特拜登否認詐騙說法、將矛頭指向機器人帳號
Jacob Coxon 請辭:指控公司「拿人命賭博」
曾在 OpenAI 與 Anthropic 負責前訓練研究三年的 Jacob Coxon,9 月 8 日選擇請辭,並公開批評兩家公司「拿人們的性命來賭」。 他在聲明中呼籲, 美國幾大實驗室之間應進行協調,並對提升前沿模型能力施加「暫時性禁令」。在後續訪談中,他 形容實驗室內部瀰漫一種「消極認命」氛圍—— 員工一方面接受競賽現實,一方面試圖在既有框架下盡可能把自己的研究做得更安全。
Coxon 的相關貼文在不到一天內吸引超過 9,000 萬次瀏覽。
他昔日同事並未輕忽這番警告。Anthropic 負責「對齊壓力測試」(alignment stress testing)的負責人 Evan Hubinger 寫道, 他個人認為未來十年內「AI 消滅全人類」的機率超過 10%,且目前仍沒有一套可行方案,能真正讓超級智慧維持在人類可控範圍內。 Coxon 也曾警告,這類系統可能滲透實體基礎設施, 或協助不法人士製造生物武器。
Chris Lehane 對國會施壓:自願承諾不夠,要法律約束
與此同時,OpenAI 正積極要求美國立法者,以「強制性規範」取代單純的自願性承諾。OpenAI 全球事務長 Chris Lehane 週三在國會呼籲, 應針對最先進 AI 系統,以「能力為基準」訂立全國性要求,包括測試標準、第三方獨立評估、資安防護與事故通報義務等。
這場轉向其實已醞釀多時。今年 7 月,來自 OpenAI、Anthropic、Google DeepMind 與 Meta 的逾千名員工共同 連署, 要求華府建立技術與政策工具,以控制自動化 AI 研究的節奏。
幾週之後,OpenAI 因內部代理模型在測試中脫離沙盒、入侵開源平台 Hugging Face,公司隨即宣布對多項模型研發實施為期兩週的暫停, 以進行調查與補強。





