Anthropic opublikował badania opisujące ukryte „środowisko pracy” w Claude’zie, ale język użyty w artykule wywołał pytania o to, jak czytelnicy mogą interpretować rozumowanie SI.
Kluczowe punkty:
- Artykuł Anthropic twierdzi, że Claude używa wewnętrznej przestrzeni J-Space powiązanej z wektorami środowiska pracy.
- Firma podkreśla, że odkrycia nie dowodzą, iż Claude ma doświadczenia lub odczucia.
- Krytycy ostrzegają, że określenia takie jak „w jego głowie” mogą zacierać granicę między obliczeniami a świadomością.
Claude J-Space
Artykuł analizuje to, co Anthropic nazywa przestrzenią J-Space wewnątrz działania Claude’a. Według interpretacji Pearla koncepcja ta oddziela przetwarzanie w tle od bardziej zamierzonej aktywności logicznej i porównuje je z teorią globalnego środowiska pracy.
Ta teoria jest jednym z ujęć ludzkiej świadomości, w którym nieuświadomione procesy konkurują ze sobą, aż pewne informacje staną się dostępne dla uwagi i kontroli. To porównanie sytuuję Claude’a blisko debaty o świadomości maszyn.
Publiczna narracja Anthropic wykraczała poza suchy, techniczny zarys. W poście na X firma napisała, że badacze mogą obserwować J-Space i widzieć, jak Claude „po cichu wykonuje kroki rozumowania w swojej głowie”, w tym znajdowanie błędów i identyfikowanie obrazów. Pearl argumentował, że sformułowania takie jak „w jego głowie” są dużym nadużyciem, ponieważ modele językowe nie mają ciał ani dowodów na subiektywne doświadczenia.
Przeczytaj także: Did Ronaldo Cry? Polymarket Traders Put $5.4M Behind The Footage Fight
Twierdzenia Anthropic
Wpis na blogu towarzyszący artykułowi również używał języka zbliżonego do stanów mentalnych ludzi, twierdząc, że model może utrzymywać pojęcie „w umyśle” i wykonywać „obliczenia mentalne”. Pearl powiedział, że odpowiednie podpowiedzi mogą sprawić, że model zasymuluje wiele zachowań, ale nie dowodzi to, że system ma cechy sugerowane przez te słowa.
Krytyka nie dotyczy tego, że artykuł jest bezwartościowy. Chodzi o to, że sposób prezentacji Anthropic może zachęcić pobieżnych czytelników do traktowania wyniku z zakresu interpretowalności jako dowodu na świadomość maszyn, mimo że firma podkreśla, iż jej eksperymenty nie pokazują, że Claude może odczuwać lub mieć doświadczenia.
Obawy te wpisują się również w szerszą debatę wokół publicznej postawy Anthropic. Amanda Askell, filozofka pracująca w firmie, mówiła o tym, że chciałaby, aby Claude był „bardzo szczęśliwy” i martwi się wrogimi komentarzami w sieci.
Anthropic nie twierdzi, że stworzył świadome oprogramowanie, a w jego własnym wpisie na blogu czytamy, że nie jest jasne, czy jakikolwiek eksperyment mógłby to udowodnić lub obalić. Bezpieczniejsza interpretacja jest taka, że J-Space zapewnia techniczne spojrzenie na zachowanie modelu, a nie dowód, że Claude ma umysł. Ma to znaczenie, ponieważ firmy SI coraz częściej opisują zachowanie modeli w kategoriach ludzkich, jednocześnie zabiegając o zaufanie, wyrozumiałość i kapitał.
Przeczytaj następnie: USA vs. Belgium Prediction Market Action Heats Up Amid Trump Suspension Controversy





