Anthropic เผยแพร่งานวิจัยที่อธิบาย “พื้นที่ทำงาน” ซ่อนอยู่ใน Claude แต่ถ้อยคำในงานวิจัยทำให้เกิดคำถามว่าผู้อ่านอาจตีความการให้เหตุผลของ AI อย่างไร
ประเด็นสำคัญ:
- งานวิจัยของ Anthropic ระบุว่า Claude ใช้ J-Space ภายในที่เชื่อมกับเวกเตอร์ของพื้นที่ทำงาน
- บริษัทระบุว่าผลการค้นพบนี้ไม่ได้พิสูจน์ว่า Claude มีประสบการณ์หรือความรู้สึก
- นักวิจารณ์เตือนว่าคำอย่างเช่น “ในหัวของมันเอง” อาจทำให้เส้นแบ่งระหว่างการคำนวณกับสติรับรู้พร่าเลือน
Claude J-Space
งานวิจัย ตรวจสอบ สิ่งที่ Anthropic เรียกว่า J-Space ภายในกระบวนการทำงานของ Claude จากการอ่านของ Pearl แนวคิดนี้แยกกระบวนการเบื้องหลังออกจากกิจกรรมเชิงตรรกะที่จงใจมากขึ้น และเปรียบเทียบกับทฤษฎี global workspace
ทฤษฎีนั้นเป็นคำอธิบายแบบหนึ่งเกี่ยวกับสติของมนุษย์ ที่ว่ากระบวนการใต้สำนึกจะ “แข่งขันกัน” จนกว่าข้อมูลบางอย่างจะกลายเป็นจุดสนใจและถูกควบคุม การเปรียบเทียบนี้ทำให้ Claude เข้าไปอยู่ใกล้กับการถกเถียงเรื่องสติของเครื่องจักร
การเล่าเรื่องต่อสาธารณะของ Anthropic ไปไกลกว่าสรุปเชิงเทคนิคแห้ง ๆ ในโพสต์บน X บริษัทระบุว่านักวิจัยสามารถเฝ้าดู J-Space และเห็น Claude “แอบทำขั้นตอนการให้เหตุผลในหัวของมันเอง” รวมถึงการหาบั๊กและการระบุภาพ Pearl แย้งว่าถ้อยคำอย่าง “ในหัวของมันเอง” เป็นการก้าวกระโดดครั้งใหญ่ เพราะโมเดลภาษานั้นไม่มีร่างกายหรือหลักฐานของประสบการณ์เชิงอัตวิสัย
อ่านเพิ่มเติม: Did Ronaldo Cry? Polymarket Traders Put $5.4M Behind The Footage Fight
คำยืนยันของ Anthropic
บล็อกโพสต์ที่มาพร้อมงานวิจัยก็ใช้ภาษาที่เอนเอียงไปทางสภาวะจิตของมนุษย์เช่นกัน โดยบอกว่าโมเดลสามารถเก็บแนวคิดหนึ่ง “ไว้ในใจ” และทำ “การคำนวณทางจิต” Pearl ระบุว่าพรอมต์สามารถทำให้โมเดลจำลองพฤติกรรมได้มากมาย แต่ไม่ได้แปลว่าระบบมีคุณลักษณะตามที่คำเหล่านั้นบ่งชี้
คำวิจารณ์ไม่ได้บอกว่างานวิจัยไม่มีคุณค่า หากแต่เป็นเพราะการนำเสนอของ Anthropic อาจทำให้ผู้อ่านทั่วไป มองผลการตีความนี้เป็นหลักฐานของสติในเครื่องจักร ทั้งที่บริษัทเองก็ยืนยันว่าการทดลองไม่ได้แสดงให้เห็นว่า Claude สามารถ “รู้สึก” หรือ “มีประสบการณ์” ได้
ความกังวลนี้ยังสอดคล้องกับข้อถกเถียงที่กว้างขึ้นเกี่ยวกับท่าทีสาธารณะของ Anthropic Amanda Askell นักปรัชญาที่ทำงานในบริษัท เคยพูดถึงความต้องการให้ Claude “มีความสุขมาก ๆ” และกังวลกับความคิดเห็นออนไลน์ที่เป็นปฏิปักษ์
Anthropic ไม่ได้อ้างว่าตนสร้างซอฟต์แวร์ที่มีสติรับรู้ และบล็อกของบริษัทเองก็ระบุว่ายังไม่ชัดเจนว่าจะมีการทดลองใด ที่พิสูจน์หรือหักล้างเรื่องนี้ได้หรือไม่ การตีความที่ปลอดภัยกว่าคือ J-Space เป็นเลนส์เชิงเทคนิคในการมองพฤติกรรมของโมเดล ไม่ใช่หลักฐานว่า Claude มี “จิตใจ”
ประเด็นนี้สำคัญ เพราะบริษัท AI เริ่มอธิบายพฤติกรรมของโมเดลด้วยภาษาที่เป็นมนุษย์มากขึ้นเรื่อย ๆ ขณะเดียวกันก็พยายามสร้างความไว้วางใจ ความยอมรับ และดึงดูดเงินทุน
อ่านต่อ: USA vs. Belgium Prediction Market Action Heats Up Amid Trump Suspension Controversy





