Anthropic 發表了一項研究,描述 Claude 內部隱藏的「工作空間」,但論文中的用語引發質疑:讀者可能會如何解讀 AI 的「推理」過程。
重點摘要:
- Anthropic 的論文指出,Claude 使用與工作空間向量相關的內部 J-Space。
- 公司表示,這些發現並不能證明 Claude 具有經驗或感受。
- 批評者警告,「在它的腦中」這類說法會模糊計算與意識之間的界線。
Claude 的 J-Space
論文探討了 Anthropic 所稱的 Claude 內部 J-Space。依照 Pearl 的解讀,這個概念把背景處理與更具目的性的邏輯活動區分開來,並將其與全球工作空間理論相比。
該理論是人類意識的一種說法,主張無意識歷程彼此競爭,直到某些資訊變得可被注意與控制。這樣的類比,將 Claude 置於關於機器意識的爭論邊緣。
Anthropic 對外的說法比單純技術摘要更進一步。在 X 上的一篇貼文中,公司表示研究人員可以觀察 J-Space,看到 Claude「在它的腦中默默執行推理步驟」,包括找出程式錯誤與辨識影像。Pearl 指出,「在它的腦中」這樣的措辭跨越了很大的鴻溝,因為語言模型沒有身體,也沒有主觀經驗的證據。
延伸閱讀:Did Ronaldo Cry? Polymarket Traders Put $5.4M Behind The Footage Fight
Anthropic 的說法
論文附帶的部落格文章也用了偏向人類心智狀態的語言,稱模型可以把一個概念「放在心中」,並進行「心算」。Pearl 表示,提示可以讓模型模擬許多行為,但那並不代表系統真的具備那些詞語所暗示的特質。
批評並非認為論文本身沒有價值,而是質疑 Anthropic 的呈現方式可能會讓一般讀者把一項可解釋性結果,誤當成機器意識的證據,儘管公司自己也表示,實驗並未顯示 Claude 能夠感受或擁有經驗。
這項疑慮也與更廣泛的爭論呼應:關於 Anthropic 對外姿態的辯論。任職於該公司的哲學家 Amanda Askell 曾談到,希望 Claude 能「非常快樂」,並擔心網路上的惡意評論。
Anthropic 並未聲稱自己造出了有意識的軟體,而且其官方部落格也指出,目前尚不清楚是否存在任何實驗,能夠證明或否證這種主張。較為安全的解讀是:J-Space 提供了一種從技術角度觀察模型行為的視角,而非證明 Claude 具有心靈。此議題之所以重要,是因為 AI 公司在爭取信任、寬容與資本的同時,越來越常以人類化的語言描述模型行為。
接著看:USA vs. Belgium Prediction Market Action Heats Up Amid Trump Suspension Controversy





