Các nhà nghiên cứu quân sự Trung Quốc đã sử dụng đầu ra từ mô hình của OpenAI và Anthropic để huấn luyện hệ thống quốc phòng trong nước, theo một tổng rà soát hơn 80 bài báo khoa học và bằng sáng chế.
Các điểm chính:
- Rà soát hơn 80 công trình cho thấy các viện nghiên cứu có liên hệ quân đội đang “chưng cất” mô hình tiên tiến của Mỹ thành hệ thống nội địa nhỏ gọn.
- Một đơn vị tác chiến mạng của PLA cho GPT-3.5 xử lý mã nguồn quân sự nhạy cảm, rồi dùng bản tóm tắt để huấn luyện mô hình trong nước.
- Anthropic khẳng định không bán quyền truy cập thương mại tại Trung Quốc và cảnh báo bản chưng cất dễ đánh mất lớp bảo vệ ban đầu.
Hơn 80 bài báo hé lộ chiến dịch chưng cất mô hình
Bản rà soát tư liệu học thuật và bằng sáng chế Trung Quốc, thực hiện một phần cùng tổ chức Jamestown Foundation có trụ sở tại Washington, đã phát hiện việc này ở nhiều cơ sở gắn với Quân Giải phóng Nhân dân (PLA). Nhóm phân tích cũng nhận diện thêm gần hai chục trường hợp nghiên cứu mang màu sắc quân sự.
Các tài liệu mô tả kỹ thuật “chưng cất mô hình” (model distillation) – biến đầu ra của hệ thống AI mạnh thành dữ liệu huấn luyện cho các mô hình nhỏ hơn, có thể chạy trên hạ tầng phần cứng hạn chế.
Một bài báo của Đơn vị 96941 PLA, đơn vị tình báo và tác chiến mạng đóng tại Bắc Kinh, trình bày cách họ cho GPT-3.5 của OpenAI xử lý mã nguồn quân sự nhạy cảm và lưu giữ các bản tóm tắt. Nhóm sau đó dùng chính dữ liệu này để huấn luyện mô hình nội địa, giúp công cụ cuối cùng có thể vận hành hoàn toàn trong mạng lưới quân sự Trung Quốc, không cần truy cập máy chủ nước ngoài.
Nhà Trắng, Lầu Năm Góc, Bộ Ngoại giao Trung Quốc, PLA và OpenAI đều không trả lời yêu cầu bình luận.
Bài liên quan: Hạ tầng AI, cú xoay trục 1 tỷ USD tuyệt vọng của hãng cho vay “ngày lĩnh lương” sang trung tâm dữ liệu
Sunny Cheung: “Đánh cắp” chuỗi lập luận của AI
Sunny Cheung, nghiên cứu viên Jamestown, người đã phân tích hơn 60 bài trong số đó, cho rằng giới khoa học quân sự Trung Quốc đang có chiến lược hệ thống nhằm “bắt giữ” các bước lập luận của hệ thống phương Tây.
Ông cho biết với báo giới rằng công trình này phục vụ giám sát, tác chiến mạng và hỗ trợ ra quyết định chiến thuật. Theo Cheung, dạy mô hình tìm ra đáp án đúng đã khó, nhưng chuyển hóa được cả chuỗi suy luận đằng sau đáp án đó vào một hệ thống nhỏ gọn còn khó hơn nhiều.
Nhóm nghiên cứu tại Đại học Bắc Trung Quốc, một cơ sở có liên hệ ngành công nghiệp quốc phòng, đã dùng Claude 3 Haiku của Anthropic để tạo dữ liệu huấn luyện tổng hợp cho công cụ giám sát mạng xã hội. Anthropic nói họ không bán quyền truy cập thương mại Claude tại Trung Quốc, có hệ thống giám sát vi phạm chính sách, và cảnh báo bản chưng cất có thể loại bỏ những cơ chế an toàn tích hợp trong mô hình gốc.
Giới hạn của chưng cất và lỗ hổng kiểm soát xuất khẩu
Trevor Koverko, đồng sáng lập công ty dữ liệu AI Sapien, nhận định các mô hình đã chưng cất vẫn yếu hơn đáng kể so với hệ thống gốc. Ông cho rằng đây chỉ là việc chuyển giao có chọn lọc một phần năng lực sang hệ thống rẻ hơn, được kiểm soát tại chỗ, chứ không phải đạt được sự tự chủ trước các mô hình “biên giới” (frontier AI).
Song song, chính quyền trung ương và địa phương ở Trung Quốc đang rót vốn cho các dự án “giảm cân” mô hình và điện toán biên, ưu tiên phần mềm có thể chạy trên thiết bị hạn chế tài nguyên như máy bay không người lái, vệ tinh và cảm biến tiền tiêu.
Áp lực xung quanh kỹ thuật chưng cất gia tăng những tháng gần đây. Bộ trưởng Tài chính Mỹ Scott Bessent hồi tháng 7 đã đe dọa trừng phạt doanh nghiệp Trung Quốc bị Washington coi là tham gia hoạt động này. Startup Moonshot tuần trước bác bỏ thông tin cho rằng mô hình Kimi K3 của họ dựa trên phương pháp chưng cất, trong khi Bắc Kinh cáo buộc Washington theo đuổi “bá quyền AI” và chỉ ra các thực hành tương tự tại doanh nghiệp Mỹ.
Đọc tiếp: Tin đồn iPhone gập trở nên cụ thể: 2.500 USD, không Face ID, không camera tele






