Các nhà nghiên cứu quân sự Trung Quốc đã sử dụng đầu ra từ các mô hình của OpenAI và Anthropic để huấn luyện hệ thống quốc phòng trong nước, theo một tổng hợp hơn 80 bài báo học thuật và bằng sáng chế mới được công bố.
Các điểm chính:
- Hơn 80 bài báo và bằng sáng chế của Trung Quốc cho thấy các tổ chức gắn với quân đội đang “chưng cất” mô hình tiên tiến của Mỹ thành những hệ thống nội địa nhỏ gọn hơn.
- Một đơn vị tác chiến mạng của PLA đã cho GPT-3.5 xử lý mã nguồn quân sự nhạy cảm, sau đó dùng phần tóm tắt để huấn luyện mô hình trong nước.
- Anthropic khẳng định không cung cấp dịch vụ thương mại tại Trung Quốc và cảnh báo bản chưng cất có thể đánh mất các lớp bảo vệ an toàn của bản gốc.
Chưng cất mô hình trong hơn 80 công trình của Trung Quốc
Bản rà soát tài liệu do một phần được thực hiện cùng Jamestown Foundation có trụ sở tại Washington đã chỉ ra việc sử dụng kỹ thuật này tại nhiều cơ sở nghiên cứu liên kết với Quân giải phóng Nhân dân Trung Quốc (PLA). Nhóm nghiên cứu còn xác định thêm khoảng hai chục nghiên cứu tình huống khác có dấu hiệu liên quan quân đội.
Các tài liệu mô tả kỹ thuật “chưng cất mô hình” (model distillation) – biến đầu ra của một hệ thống AI mạnh thành bộ dữ liệu huấn luyện cho những mô hình nhỏ hơn, có thể chạy trên hạ tầng phần cứng khiêm tốn.
Một bài báo của Đơn vị 96941 thuộc PLA – đơn vị tình báo và tác chiến mạng đặt tại Bắc Kinh – mô tả việc cho GPT-3.5 của OpenAI xử lý mã nguồn quân sự nhạy cảm và lưu lại các bản tóm tắt. Nhóm nghiên cứu sau đó dùng chính dữ liệu này để huấn luyện mô hình nội địa, giúp công cụ cuối cùng vận hành hoàn toàn trong mạng lưới quân sự Trung Quốc, không phụ thuộc máy chủ nước ngoài.
Nhà Trắng, Lầu Năm Góc, Bộ Ngoại giao Trung Quốc, PLA và OpenAI đều chưa phản hồi trước các yêu cầu bình luận.
Bài liên quan: Hạ tầng AI, cú xoay trục 1 tỷ USD tuyệt vọng của hãng cho vay lãi cao sang mảng trung tâm dữ liệu
Sunny Cheung nói về “đánh cắp” năng lực lập luận AI
Sunny Cheung, nghiên cứu viên Jamestown – người trực tiếp phân tích hơn 60 bài báo – cho biết giới khoa học quân sự Trung Quốc đang có chiến lược hệ thống hóa việc thu giữ các bước lập luận trung gian của những hệ thống AI phương Tây.
Ông cho biết với báo giới rằng các nghiên cứu này phục vụ giám sát, tác chiến mạng và hỗ trợ ra quyết định chiến thuật. Theo Cheung, dạy mô hình cho ra “đáp án đúng” đã khó, nhưng chuyển toàn bộ chuỗi lập luận đằng sau đáp án đó vào một hệ thống nhỏ gọn hơn còn khó gấp bội.
Nhóm nghiên cứu tại Đại học Bắc Trung Quốc – cơ sở được cho là gắn với ngành công nghiệp vũ khí – đã dùng Claude 3 Haiku của Anthropic để tạo dữ liệu huấn luyện tổng hợp cho một công cụ giám sát mạng xã hội. Anthropic khẳng định không cung cấp quyền truy cập thương mại với Claude tại Trung Quốc, có các hệ thống giám sát để phát hiện vi phạm chính sách, đồng thời cảnh báo rằng các bản chưng cất có thể loại bỏ các cơ chế an toàn được tích hợp trong bản gốc.
Giới hạn của chưng cất và lỗ hổng kiểm soát xuất khẩu
Trevor Koverko, đồng sáng lập công ty dữ liệu AI Sapien, cho rằng các mô hình chưng cất vẫn yếu hơn đáng kể so với hệ thống gốc. Ông nhận định đây là quá trình “chuyển giao một phần năng lực” sang hệ thống rẻ hơn, do địa phương kiểm soát, hơn là đạt tới sự tự chủ thực sự so với các mô hình biên tiên tiến.
Song song, chính quyền trung ương và địa phương tại Trung Quốc đang rót vốn cho các chương trình “làm nhẹ mô hình” và điện toán biên, ưu tiên trợ cấp cho phần mềm có thể chạy trên drone, vệ tinh và các thiết bị hạn chế tài nguyên khác.
Áp lực xung quanh kỹ thuật này tích tụ trong nhiều tháng qua, và Bộ trưởng Tài chính Mỹ Scott Bessent đã dọa áp lệnh trừng phạt từ tháng 7 đối với những công ty Trung Quốc bị coi là sử dụng chưng cất trái phép. Startup Moonshot tuần trước phủ nhận mô hình Kimi K3 của họ dựa trên phương pháp này, trong khi Bắc Kinh cáo buộc Washington theo đuổi “bá quyền AI” và chỉ ra những thực hành tương tự tại một số doanh nghiệp Mỹ.
Bài tiếp theo: Tin đồn iPhone gập ngày càng rõ: 2.500 USD, không Face ID, không camera tele





