Claude 論文點燃「AI 意識」爭論 Anthropic 卻不願完全擁抱

Claude 論文點燃「AI 意識」爭論 Anthropic 卻不願完全擁抱

Anthropic 發表了一項研究,描述 Claude 內部一個隱藏的「工作空間」,但論文中使用的語言,引發了外界對讀者如何理解 AI 推理方式的疑問。

重點摘要:

  • Anthropic 的論文指出,Claude 使用與工作空間向量相關的內部 J-Space。
  • 公司強調,這些研究結果並不能證明 Claude 具有感受或情緒。
  • 批評者警告,「在它的腦海裡」等用詞,可能模糊了計算與意識之間的界線。

Claude 的 J-Space

論文探討了 Anthropic 所說的 Claude 內部 J-Space 運作。依 Pearl 的解讀,這個概念把背景處理與更具刻意性的邏輯活動區分開來,並把它拿來與全球工作空間理論相比。

該理論是解釋人類意識的一種說法,認為無意識歷程彼此競爭,直到某些資訊變得可被注意與控制。這種比較,將 Claude 置於關於機器意識的爭論邊緣。

Anthropic 對外的說法,也比單純的技術摘要來得煽動。在 X 上的一篇貼文中,公司表示研究人員可以觀察 J-Space,看到 Claude「在它的腦海裡默默執行推理步驟」,包括找出程式錯誤與辨識影像。Pearl 則指出,「在它的腦海裡」這種說法跨出了一大步,因為語言模型沒有身體,也沒有任何主觀經驗的證據。

延伸閱讀:Did Ronaldo Cry? Polymarket Traders Put $5.4M Behind The Footage Fight

Anthropic 的說法

隨論文發布的部落格貼文,也用了偏向人類心理狀態的語言,聲稱模型可以把某個概念「記在心裡」,並進行「心算」。Pearl 表示,提示可以讓模型模擬許多行為,但這並不代表系統真正具備這些字眼所暗示的特質。

批評者並不是認為這篇論文沒有價值,而是擔心 Anthropic 的呈現方式,會讓一般讀者把一項可解釋性成果,誤當成機器意識的證據,即便公司自己也說,實驗並未顯示 Claude 能夠感受或擁有經驗。

這個疑慮也呼應了圍繞 Anthropic 公共姿態的更大爭論。公司任職的哲學家 Amanda Askell 曾談到,希望 Claude「非常快樂」,也會擔心網路上的惡意評論。

Anthropic 並未聲稱自己創造了有意識的軟件,公司部落格也表示,目前仍不清楚是否有任何實驗能證明或否定這種事情。較安全的解讀是:J-Space 提供了一種從技術角度理解模型行為的鏡頭,而不是證明 Claude 具備心靈。這個問題之所以重要,是因為 AI 公司在爭取信任、寬容與資本時,越來越常用人類化語言來形容模型行為。

下一篇閱讀:USA vs. Belgium Prediction Market Action Heats Up Amid Trump Suspension Controversy

免責聲明及風險提示: 本文資訊僅供教育與參考之用,並基於作者意見,並不構成金融、投資、法律或稅務建議。 加密貨幣資產具高度波動性並伴隨高風險,可能導致投資大幅虧損或全部損失,並非適合所有投資者。 文章內容僅代表作者觀點,不代表 Yellow、創辦人或管理層立場。 投資前請務必自行徹底研究(D.Y.O.R.),並諮詢持牌金融專業人士。
Claude 論文點燃「AI 意識」爭論 Anthropic 卻不願完全擁抱 | Yellow