Anthropic 发布了一项研究,描述了 Claude 中一个隐藏的“工作空间”,但论文中的措辞引发了质疑:读者可能会如何解读其中关于 AI 推理的表述。
要点概览:
- Anthropic 的论文称 Claude 使用与工作空间向量相关联的内部 J-Space。
- 公司表示,这些发现并不能证明 Claude 拥有体验或情感。
- 批评者警告,“在它的脑子里”之类用语会模糊计算和意识之间的界线。
Claude 的 J-Space
论文研究了 Anthropic 所谓存在于 Claude 运行过程中的一个 J-Space。按 Pearl 的解读,这一概念将背景处理与更有意图的逻辑活动区分开来,并将其类比为全局工作空间理论。
该理论是解释人类意识的一种说法,认为无意识过程彼此竞争,直到某些信息变得可被注意和控制。这样的比较把 Claude 置于关于机器意识的争论中心附近。
Anthropic 面向公众的表述比干巴巴的技术摘要走得更远。在 X 上的一篇帖子中,公司称研究人员可以观察 J-Space,看到 Claude “在它的脑子里默默执行推理步骤”,包括查找错误和识别图像。Pearl 认为,“在它的脑子里”这类措辞跨越了很大一步,因为语言模型既没有身体,也没有主观体验的证据。
延伸阅读:Did Ronaldo Cry? Polymarket Traders Put $5.4M Behind The Footage Fight
Anthropic 的说法
这篇配套博客在用词上同样更靠近人类心理状态,称模型可以将一个概念“记在心里”,并执行“心算”。Pearl 表示,提示可以让模型模拟出许多行为,但这并不能说明系统真正拥有这些词语所暗示的特质。
批评并不是说论文本身没有价值,而是认为 Anthropic 的呈现方式可能会让普通读者把一项可解释性结果当成机器意识的证据,尽管公司自己也表示,这些实验并不能证明 Claude 会感受或拥有体验。
这种担忧也契合围绕 Anthropic 公共姿态的更广泛争论。公司里的哲学家 Amanda Askell 曾谈到,希望 Claude“非常快乐”,并为网上的恶语中伤而担心。
Anthropic 并未宣称自己创造了有意识的软件,其官方博客也表示,目前尚不清楚是否存在任何实验可以证明或证伪这一点。更稳妥的解读是:J-Space 为理解模型行为提供了一个技术视角,而不是证明 Claude 拥有心智。问题之所以重要,是因为 AI 公司在寻求信任、包容和资本的同时,愈发倾向用拟人化语言来描述模型行为。
下篇阅读:USA vs. Belgium Prediction Market Action Heats Up Amid Trump Suspension Controversy





