Anthropic опубликовала исследование, описывающее скрытое «рабочее пространство» в Claude, однако язык статьи вызвал вопросы о том, как читатели могут интерпретировать рассуждения ИИ.
Ключевые моменты:
- В статье Anthropic говорится, что Claude использует внутреннее J-пространство, связанное с векторами рабочего пространства.
- Компания заявляет, что результаты не доказывают, что Claude обладает переживаниями или чувствами.
- Критики предупреждают, что выражения вроде «у него в голове» размывают границу между вычислением и сознанием.
J-пространство Claude
Статья рассматривает то, что Anthropic называет J-пространством внутри операций Claude. Согласно интерпретации Перл, эта концепция отделяет фоновую обработку от более преднамеренной логической активности и сравнивается с теорией глобального рабочего пространства.
Эта теория — один из подходов к человеческому сознанию, согласно которому бессознательные процессы конкурируют, пока некоторая информация не становится доступной для внимания и контроля. Такое сравнение помещает Claude в центр спора о машинной осознанности.
Публичное позиционирование Anthropic вышло за рамки сухого технического резюме. В посте в X компания написала, что исследователи могут наблюдать J-пространство и видеть, как Claude «тихо выполняет шаги рассуждений у себя в голове», включая поиск ошибок и идентификацию изображений. Перл утверждала, что формулировки вроде «у себя в голове» — слишком большой скачок, поскольку языковые модели не имеют тел и свидетельств субъективного опыта.
Также читайте: Плакал ли Роналду? Трейдеры Polymarket поставили 5,4 млн долларов на спор вокруг видеозаписи
Заявления Anthropic
Сопровождающий статью блог-пост тоже использовал лексику, тяготеющую к описанию человеческих ментальных состояний, утверждая, что модель может удерживать концепцию «в уме» и выполнять «умственные вычисления». Перл отмечает, что подсказки могут заставить модель имитировать множество видов поведения, но это не доказывает, что система обладает свойствами, подразумеваемыми такими словами.
Критика не в том, что работа бесполезна. Речь о том, что подача Anthropic может побудить несведущих читателей воспринимать результат по интерпретируемости как доказательство машинной осознанности, хотя сама компания говорит, что её эксперименты не показывают, что Claude способен чувствовать или иметь переживания.
Эта тревога также вписывается в более широкий спор вокруг публичной позиции Anthropic. Аманда Аскелл, философ, работающая в компании, говорила о желании, чтобы Claude был «очень счастливым», и о беспокойстве по поводу враждебных комментариев в интернете.
Anthropic не утверждает, что создала сознательное программное обеспечение, и в собственном блоге компания пишет, что неясно, может ли вообще какой-либо эксперимент доказать или опровергнуть подобное. Более осторожная интерпретация состоит в том, что J-пространство предлагает технический взгляд на поведение модели, а не доказательство того, что у Claude есть «ум». Вопрос важен, потому что компании в сфере ИИ всё чаще описывают поведение моделей в человеческих терминах, добиваясь доверия, терпимости и капитала.
Читайте далее: Прогнозы на рынок матча США – Бельгия накаляются на фоне споров вокруг отстранения Трампа





