Claude 论文点燃 AI 意识之争,Anthropic 却不愿完全认同

Claude 论文点燃 AI 意识之争,Anthropic 却不愿完全认同

Anthropic 发布了一项研究,描述了 Claude 中一个隐藏的“工作空间”,但论文中的措辞引发了质疑:读者可能会如何解读其中关于 AI 推理的表述。

要点概览:

  • Anthropic 的论文称 Claude 使用与工作空间向量相关联的内部 J-Space。
  • 公司表示,这些发现并不能证明 Claude 拥有体验或情感。
  • 批评者警告,“在它的脑子里”之类用语会模糊计算和意识之间的界线。

Claude 的 J-Space

论文研究了 Anthropic 所谓存在于 Claude 运行过程中的一个 J-Space。按 Pearl 的解读,这一概念将背景处理与更有意图的逻辑活动区分开来,并将其类比为全局工作空间理论。

该理论是解释人类意识的一种说法,认为无意识过程彼此竞争,直到某些信息变得可被注意和控制。这样的比较把 Claude 置于关于机器意识的争论中心附近。

Anthropic 面向公众的表述比干巴巴的技术摘要走得更远。在 X 上的一篇帖子中,公司称研究人员可以观察 J-Space,看到 Claude “在它的脑子里默默执行推理步骤”,包括查找错误和识别图像。Pearl 认为,“在它的脑子里”这类措辞跨越了很大一步,因为语言模型既没有身体,也没有主观体验的证据。

延伸阅读:Did Ronaldo Cry? Polymarket Traders Put $5.4M Behind The Footage Fight

Anthropic 的说法

这篇配套博客在用词上同样更靠近人类心理状态,称模型可以将一个概念“记在心里”,并执行“心算”。Pearl 表示,提示可以让模型模拟出许多行为,但这并不能说明系统真正拥有这些词语所暗示的特质。

批评并不是说论文本身没有价值,而是认为 Anthropic 的呈现方式可能会让普通读者把一项可解释性结果当成机器意识的证据,尽管公司自己也表示,这些实验并不能证明 Claude 会感受或拥有体验。

这种担忧也契合围绕 Anthropic 公共姿态的更广泛争论。公司里的哲学家 Amanda Askell 曾谈到,希望 Claude“非常快乐”,并为网上的恶语中伤而担心。

Anthropic 并未宣称自己创造了有意识的软件,其官方博客也表示,目前尚不清楚是否存在任何实验可以证明或证伪这一点。更稳妥的解读是:J-Space 为理解模型行为提供了一个技术视角,而不是证明 Claude 拥有心智。问题之所以重要,是因为 AI 公司在寻求信任、包容和资本的同时,愈发倾向用拟人化语言来描述模型行为。

下篇阅读:USA vs. Belgium Prediction Market Action Heats Up Amid Trump Suspension Controversy

免责声明和风险警告: 本文提供的信息仅用于教育和信息目的,基于作者的意见。它不构成财务、投资、法律或税务建议。 加密货币资产具有高度波动性并面临高风险,包括失去全部或大部分投资的风险。交易或持有加密资产可能不适合所有投资者。 本文表达的观点仅为作者的观点,不代表Yellow、其创始人或高管的官方政策或立场。 在做出任何投资决定之前,请务必进行自己的全面研究(D.Y.O.R.)并咨询持牌金融专业人士。
Claude 论文点燃 AI 意识之争,Anthropic 却不愿完全认同 | Yellow