Anthropic đang triển khai hệ thống “watermark” vô hình cho văn bản do Claude tạo ra và chữ ký nguồn gốc tệp (file provenance) trên phạm vi toàn cầu, theo khuôn khổ minh bạch của EU với khoảng 190 bên ký kết – và động thái này đang vấp phải nhiều ý kiến phản đối.
Các điểm đáng chú ý:
- Văn bản Claude tạo sẽ kèm “watermark” có thể đọc được bằng máy và vẫn tồn tại ngay cả khi người dùng sao chép – dán; các tệp được hỗ trợ sẽ có metadata nguồn gốc được ký số.
- Chính sách áp dụng trên toàn cầu với các mô hình Claude được hỗ trợ; các mô hình cũ đang được nâng cấp trong giai đoạn chuyển tiếp.
- Giới phê bình lo ngại công việc hiệu đính hay lập trình có thể bị gắn cờ là nội dung AI, ngay cả khi phần lớn nội dung gốc do con người soạn.
Cơ chế watermark của Claude
Anthropic đã công bố chi tiết hệ thống đánh dấu ngày 11/8, như một phần cam kết tuân thủ khung minh bạch theo Đạo luật AI của Liên minh châu Âu (AI Act). Các mô hình Claude ra mắt tại EU từ ngày 2/8 trở đi đã hỗ trợ cơ chế đánh dấu ngay từ đầu, và công ty đang bổ sung hỗ trợ cho các mô hình ra đời trước đó.
Với văn bản, hệ thống chèn watermark vô hình trực tiếp vào nội dung do mô hình sinh ra. Với các định dạng tệp được hỗ trợ như hình ảnh SVG, PNG và JPG, Anthropic sử dụng metadata nguồn gốc C2PA có chữ ký số. Hãng khẳng định watermark văn bản không làm thay đổi ý nghĩa, chất lượng hay khả năng đọc. Forbes cho biết người dùng hiện không có tùy chọn tắt tính năng này.
Tuy vậy, watermark không phải “bất khả xóa”. Việc chỉnh sửa sâu, diễn đạt lại, dịch thuật, hoặc trộn lẫn văn bản Claude với nội dung khác có thể làm mất tín hiệu nhận diện trong văn bản. Với tệp, việc chuyển đổi định dạng, lưu lại, hay chụp màn hình có thể loại bỏ metadata nguồn gốc.
Xem thêm: XRP rơi dưới mốc 1 USD khi cá voi âm thầm gom 380 triệu token
Làn sóng phản đối đối với Claude
Thông báo của Anthropic đã ngay lập tức gặp phản ứng tiêu cực trên X và Reddit, đặc biệt từ nhóm dùng Claude để hiệu đính (proofreading) và các lập trình viên lo ngại mã nguồn liên quan Claude sẽ bị gắn dấu. Phản ứng đến gần như tức thời.
Người dẫn chương trình radio kiêm blogger Erick Erickson cho rằng việc bài viết do ông tự soạn nhưng lại bị gắn watermark chỉ vì nhờ Claude đọc lại là “lố bịch”.
Lo ngại này làm lộ rõ một khác biệt quan trọng trong chính tài liệu hướng dẫn của Anthropic: phát hiện watermark chỉ cho thấy Claude có thể đã xử lý nội dung, chứ không khẳng định Claude là tác giả gốc. Công ty nêu rõ ngay cả các tác vụ như hiệu đính, dịch thuật, tóm tắt hay chuyển đổi định dạng tệp cũng có thể tạo ra đầu ra bị gắn dấu, dù nội dung ban đầu do con người hoặc hệ thống khác soạn.
Bộ quy tắc tự nguyện của EU mang tính khuyến nghị, nhưng Điều 50 về minh bạch trong Đạo luật AI đã bắt đầu có hiệu lực pháp lý từ ngày 2/8. Tính đến cuối tháng 7, khoảng 190 tổ chức đã ký vào bộ quy tắc, bao gồm Google, Meta, Microsoft, OpenAI và Anthropic.
Xu hướng không chỉ giới hạn ở Claude. OpenAI hiện đã áp dụng metadata C2PA và watermark SynthID cho các hình ảnh được hỗ trợ, cùng SynthID cho âm thanh, dù các công cụ truy vết công khai hiện tại của hãng chưa liệt kê văn bản trong số các định dạng có thể phát hiện.
Đọc tiếp: Sếp mảng Apple Pay, bà Jennifer Bailey, về hưu sau 25 năm gắn bó với Apple





