Bài nghiên cứu về Claude thổi bùng tranh luận ý thức AI mà Anthropic không muốn hoàn toàn chấp nhận

Bài nghiên cứu về Claude thổi bùng tranh luận ý thức AI mà Anthropic không muốn hoàn toàn chấp nhận

Anthropic đã công bố nghiên cứu mô tả một “không gian làm việc” ẩn trong Claude, nhưng ngôn ngữ của bài báo đã làm dấy lên câu hỏi về cách độc giả có thể diễn giải lập luận của AI.

Những điểm chính:

  • Bài báo của Anthropic nói Claude sử dụng một J-Space nội bộ gắn với các vector không gian làm việc.
  • Công ty nói các phát hiện này không chứng minh Claude có trải nghiệm hay cảm xúc.
  • Các nhà phê bình cảnh báo những thuật ngữ như “trong đầu nó” có thể làm mờ ranh giới giữa tính toán và ý thức.

J-Space của Claude

Bài báo xem xét cái mà Anthropic gọi là một J-Space bên trong hoạt động của Claude. Theo cách đọc của Pearl, khái niệm này tách biệt xử lý nền khỏi hoạt động logic có chủ đích hơn và so sánh nó với thuyết không gian làm việc toàn cục.

Học thuyết đó là một cách lý giải về ý thức con người, trong đó các quá trình vô thức cạnh tranh với nhau cho đến khi một số thông tin nhất định trở nên sẵn sàng cho chú ý và kiểm soát. Sự so sánh này đặt Claude vào gần trung tâm của cuộc tranh luận về ý thức máy.

Cách trình bày trước công chúng của Anthropic tiến xa hơn bản tóm tắt kỹ thuật khô khan. Trong một bài đăng trên X, công ty nói các nhà nghiên cứu có thể quan sát J-Space và thấy Claude “lặng lẽ thực hiện các bước suy luận trong đầu nó”, bao gồm tìm lỗi và nhận diện hình ảnh. Pearl lập luận rằng cách diễn đạt như “trong đầu nó” là một bước nhảy rất lớn, vì các mô hình ngôn ngữ không có cơ thể hay bằng chứng về trải nghiệm chủ quan.

Đọc thêm: Ronaldo có khóc không? Trader trên Polymarket bỏ 5,4 triệu đô cho cuộc chiến đoạn phim

Tuyên bố của Anthropic

Bài đăng trên blog đi kèm với bài báo cũng dùng ngôn ngữ nghiêng về các trạng thái tinh thần của con người, nói rằng mô hình có thể giữ một khái niệm “trong tâm trí” và thực hiện các “phép tính tinh thần”. Pearl nói các lời nhắc có thể khiến một mô hình mô phỏng nhiều hành vi, nhưng điều đó không cho thấy hệ thống có những đặc điểm được ngụ ý bởi các từ này.

Lời chỉ trích không phải là bài báo thiếu giá trị. Vấn đề là cách trình bày của Anthropic có thể khiến độc giả phổ thông coi một kết quả về khả giải như bằng chứng của ý thức máy, dù công ty nói các thí nghiệm của họ không cho thấy Claude có thể cảm nhận hay có trải nghiệm.

Mối lo này cũng phù hợp với một cuộc tranh luận rộng hơn về cách Anthropic thể hiện trước công chúng. Amanda Askell, một triết gia làm việc tại công ty, đã nói về mong muốn Claude “rất hạnh phúc” và lo lắng về các bình luận thù địch trên mạng.

Anthropic chưa bao giờ tuyên bố họ tạo ra phần mềm có ý thức, và chính blog của họ nói rằng không rõ liệu có bất kỳ thí nghiệm nào có thể chứng minh hay bác bỏ điều đó hay không. Cách hiểu thận trọng hơn là J-Space mang đến một lăng kính kỹ thuật để nhìn vào hành vi mô hình, chứ không phải bằng chứng cho thấy Claude có một tâm trí. Vấn đề này quan trọng vì các công ty AI ngày càng mô tả hành vi mô hình bằng ngôn ngữ nhân hóa trong khi tìm kiếm sự tin tưởng, khoan dung và vốn đầu tư.

Đọc tiếp: Kèo thị trường dự đoán USA vs. Belgium nóng lên giữa tranh cãi đình chỉ Trump

Tuyên bố miễn trừ trách nhiệm và cảnh báo rủi ro: Thông tin được cung cấp trong bài viết này chỉ dành cho mục đích giáo dục và thông tin, dựa trên ý kiến của tác giả. Nó không cấu thành lời khuyên tài chính, đầu tư, pháp lý hoặc thuế. Tài sản tiền mã hóa có tính biến động cao và chịu rủi ro cao, bao gồm rủi ro mất tất cả hoặc một phần lớn khoản đầu tư của bạn. Giao dịch hoặc nắm giữ tài sản crypto có thể không phù hợp với tất cả nhà đầu tư. Những quan điểm được bày tỏ trong bài viết này hoàn toàn là của (các) tác giả và không đại diện cho chính sách chính thức hoặc lập trường của Yellow, những người sáng lập hoặc giám đốc điều hành. Luôn tiến hành nghiên cứu kỹ lưỡng của riêng bạn (D.Y.O.R.) và tham khảo ý kiến chuyên gia tài chính được cấp phép trước khi đưa ra bất kỳ quyết định đầu tư nào.
Tin Tức Liên Quan
Bài nghiên cứu về Claude thổi bùng tranh luận ý thức AI mà Anthropic không muốn hoàn toàn chấp nhận | Yellow