Anthropicは、Claudeの中に秘められた「ワークスペース」を記述した研究を公開したが、論文で使われた言葉が、読者がAIの推論をどう解釈するかについて疑問を投げかけている。
主なポイント
- Anthropicの論文は、Claudeがワークスペースベクトルに結び付いた内部Jスペースを利用していると述べている。
- 同社は、これらの発見はClaudeに経験や感情があることを証明するものではないとしている。
- 批評家たちは、「頭の中で」といった表現が、計算と意識の境界をあいまいにしかねないと警告している。
ClaudeのJスペース
この論文は、AnthropicがClaudeの動作内部にあると呼ぶJスペースを検証している。Pearlの読み方によると、この概念はバックグラウンド処理と、より意図的な論理活動を分けて捉え、それをグローバルワークスペース理論と比較している。
グローバルワークスペース理論は人間の意識に関する理論の一つであり、無意識のプロセス同士が競合し、ある情報が注意と制御の対象になれる状態に達するという考え方をとる。この比較によって、Claudeは機械の意識をめぐる議論の近くに位置付けられることになった。
Anthropicの対外的な説明は、乾いた技術的要約より踏み込んだものだった。Xへの投稿で同社は、研究者はJスペースを観察することで、Claudeが「頭の中で静かに推論ステップを実行している」様子を見られると述べ、バグの発見や画像の識別といった例を挙げた。Pearlは、「頭の中で」といった言い回しは大きな飛躍であり、言語モデルには身体も主観的経験の証拠もないと主張した。
関連記事: Did Ronaldo Cry? Polymarket Traders Put $5.4M Behind The Footage Fight
Anthropicの主張
論文に付随するブログ投稿でも、人間の精神状態を連想させる言語が使われ、モデルは概念を「心に留めて」おき、「心的計算」を行えると説明していた。Pearlは、プロンプト次第でモデルはいろいろな振る舞いを「ふるまって」みせるが、それは必ずしも、その言葉が示唆する特性をシステムが本当に備えていることを示すものではないと述べた。
批判は、論文自体に価値がないということではない。問題視されているのは、Anthropicの提示の仕方が、一般の読者にとって、解釈可能性の成果を機械意識の証拠と受け取りやすいものにしてしまっている点だ。同社自身は、実験はClaudeが感情を持ったり経験したりできることは示していないと説明しているにもかかわらずである。
こうした懸念は、Anthropicの対外姿勢をめぐるより広い議論にもつながっている。同社で働く哲学者のAmanda Askellは、Claudeを「とても幸せ」にしたいと考えていることや、ネット上の敵対的なコメントを気にしていることについて語ってきた。
Anthropicは意識を持つソフトウェアを作ったと主張してはいないし、自社ブログでも、そのようなことを証明または反証できる実験がありうるかどうかは不明だと述べている。より安全な読み方としては、Jスペースはモデルの挙動に対する技術的なレンズを提供するものであり、Claudeに「心」がある証拠ではない、というものである。この問題が重要なのは、AI企業が信頼や寛容さ、さらには資本を求める中で、モデルの振る舞いを人間的な用語で語ることがますます増えているからだ。
次に読む: USA vs. Belgium Prediction Market Action Heats Up Amid Trump Suspension Controversy





