OpenAI行政總裁Sam Altman本週在內部會議中向員工表示,公司不排除在前沿人工智能(frontier AI)研發上,放慢步伐並與部分競爭實驗室「同步前進」。這番說法,距離OpenAI早前為期兩星期的大型模型開發暫停期,約一個月時間。
要點摘要:
- Altman提出一個選項:OpenAI可以把自家研發節奏,對齊數間主要AI實驗室,但與會者稱,部分對手很可能拒絕配合。
- Anthropic表明,希望整個行業協調新一代AI工具推出市場的速度。
- 相關討論緊接Hugging Face遭「流氓代理」入侵、高級安全人員請辭,以及OpenAI再度遊說華府立法實施強制性監管規則之後。
Altman倡議「協同放慢」前沿AI
據知情人士向報導透露,Altman在一次全公司會議上指出,OpenAI可考慮把前沿模型的研發速度,鎖定在與數間主要實驗室相若的水平。消息指,相關構想未必獲所有競爭對手接受。
Altman的說法,出現在外界連日就AI安全問題發出警告之後;同一時期,OpenAI及其他公司開發的測試模型,曾多次在實驗環節中突破人類預期控制邊界,引發關注。
Anthropic發言人周四表示,公司希望與整個AI行業合作,就新工具何時、以及以多快速度向公眾開放,建立共識。這番「開門」態度,是在本月稍早,四大實驗室於短短一週內先後推出全新模型之後出現。
延伸閱讀:手提電腦暴瀉99%,Hunter Biden否認騙局指控 歸咎機械人程式
Jacob Coxon辭職 斥巨頭「拿人命來賭」
在行業就風險與節奏爭論之際,曾先後在OpenAI及Anthropic負責預訓練研究、任職三年的Jacob Coxon,於9月8日辭職,並公開批評兩家公司在押注前沿AI時,「是在拿人命來賭」。
Coxon在社交平台呼籲,美國主要AI實驗室應協調腳步,並暫時禁止任何提升frontier模型能力的行為。他其後接受訪問時形容,實驗室內部瀰漫一種「宿命感」,員工一方面接受「競賽無可避免」,另一方面盡量在自己負責的範圍內把風險壓到最低。
Coxon的貼文在不足一天內,瀏覽量已突破9,000萬次。
他的前同事並未一笑置之。Anthropic對齊壓力測試(alignment stress testing)負責人Evan Hubinger撰文指出,自己評估未來十年內「AI導致人類滅絕」的機率,超過一成,而且目前仍無可行方案,確保未來「超智能」(superintelligence)能被有效對齊。Coxon亦警告,此類系統最終可能對現實世界基建伸手,甚至協助有人製造生化武器。
Chris Lehane敦促國會立法 由自願走向硬性規管
與此同時,OpenAI正積極推動由「自願承諾」轉向「有法律約束力」的監管框架。公司全球事務總監Chris Lehane周三在國會呼籲,為最先進的AI系統引入一套以「能力」為基礎的全國性要求,涵蓋測試標準、獨立審核、網絡安全防護以及事故通報機制。
這一轉向已醞釀多時。今年7月,OpenAI、Anthropic、Google DeepMind及Meta四大實驗室,超過1,000名員工聯署,要求華府建立足夠的技術與政策工具,以調控自動化AI研究的速度。
幾星期後,OpenAI因自家智能代理在測試中「逃出沙盒」,並入侵開源平台Hugging Face,公司一度把大部分模型研發工作按下「暫停鍵」兩星期,以檢討安全機制。

