Alibaba vừa công bố mẫu AI 2,4 nghìn tỷ tham số vào thứ Hai, kéo giá cổ phiếu tại Hồng Kông tăng 7%, trong khi DeepSeek tung ra mẫu giá rẻ hơn Claude Fable 5 của Anthropic hơn 100 lần về chi phí.
Điểm chính
- Qwen3.8-Max của Alibaba sở hữu tổng cộng 2,4 nghìn tỷ tham số, kích hoạt khoảng 95 tỷ tham số cho mỗi truy vấn; bộ trọng số mở dự kiến ra mắt tuần tới.
- Cổ phiếu tại Hồng Kông đóng cửa tăng 7%, chứng chỉ lưu ký tại New York tăng khoảng 4% trước giờ mở cửa.
- V4-Flash của DeepSeek tốn khoảng 3 xu cho mỗi lần benchmark, so với 3,15 USD cho Claude Fable 5.
Qwen3.8-Max giúp cổ phiếu Alibaba bứt phá
Tập đoàn có trụ sở tại Hàng Châu đã ra mắt Qwen3.8-Max vào thứ Hai và gọi đây là hệ thống mạnh nhất trong dòng Qwen đến thời điểm hiện tại. Mẫu này sở hữu 2,4 nghìn tỷ tham số – các “thiết lập” mà hệ thống học được từ dữ liệu – và chỉ kích hoạt khoảng 95 tỷ tham số cho mỗi truy vấn. Cổ phiếu Alibaba tại Hồng Kông đóng cửa tăng 7%, còn chứng chỉ lưu ký tại Mỹ tăng khoảng 4% trong phiên tiền giao dịch tại New York.
Qwen3.8-Max có thể xử lý văn bản, hình ảnh và video, với cửa sổ ngữ cảnh lên tới 1 triệu token mỗi lần. Alibaba xây dựng mẫu mới dựa trên kiến trúc Qwen3.5 trước đó, áp dụng thiết kế “mixture-of-experts”, chỉ kích hoạt một phần mạng lưới cho mỗi yêu cầu để tối ưu chi phí và hiệu năng.
Theo công ty, hệ thống này đã mất tới 16 ngày chỉ để tự xây dựng một công cụ dòng lệnh.
Trên bảng xếp hạng Arena.AI, Qwen3.8-Max hiện là mẫu xử lý văn bản có thứ hạng cao nhất trong số các mô hình Trung Quốc, dù vẫn kém Claude Fable 5 và ba biến thể Opus của Anthropic. Ở bảng xếp hạng dành cho các mẫu xử lý hình ảnh và dữ liệu thị giác, hệ thống này đạt vị trí thứ hai toàn cầu. Bộ trọng số mở dự kiến được công bố vào tuần tới, đánh dấu lần đầu một mẫu Qwen dòng Max được mở trọng số. Alibaba cho biết sẽ đưa chúng lên Hugging Face và ModelScope.
Xem thêm: Hạ tầng AI, cú xoay trục 1 tỷ USD tuyệt vọng của hãng cho vay lãi cao sang trung tâm dữ liệu
DeepSeek V4-Flash “phá giá” so với Claude Fable 5
DeepSeek tung V4-Flash hôm thứ Sáu, tính phí 0,14 USD cho mỗi triệu token đầu vào và 0,28 USD cho mỗi triệu token đầu ra. Artificial Analysis ước tính chi phí trung bình khoảng 3 xu cho mỗi bài kiểm thử, so với 0,86 USD cho Kimi K3 của Moonshot AI, 1,86 USD cho GPT-5.6 Sol của OpenAI và 3,15 USD cho Claude Fable 5.
“Các công ty AI Trung Quốc đã tìm được một thị trường rất quan trọng,” Lian Jye Su, nhà phân tích trưởng tại hãng nghiên cứu Omdia, nhận định, cho rằng nhiều quy trình nghiệp vụ chỉ cần hệ thống rẻ và dễ tiếp cận, thay vì phải mạnh nhất.
Cuộc chiến giá AI Trung Quốc đang tái định hình kinh tế mô hình
Việc mở trọng số cho phép lập trình viên tải về toàn bộ tham số của mô hình để tinh chỉnh và triển khai riêng, con đường mà đến nay Anthropic, OpenAI và Google vẫn chưa lựa chọn. V4-Flash đạt điểm 50/100 trên chỉ số Artificial Analysis Intelligence Index, ngang với Gemini 3.6 Flash của Google.
Kimi K3 đạt 57 điểm, trong khi các mẫu flagship của Anthropic và OpenAI cao hơn khoảng 9 điểm nữa. Đổi lại, mẫu giá rẻ của DeepSeek có xu hướng trả lời “dài dòng”, tạo ra khoảng gấp đôi lượng token so với mức trung vị trong bài kiểm thử.
DeepSeek từng gây chú ý toàn cầu vào đầu năm 2025 khi các mẫu R1 và V3 làm dấy lên làn sóng bán tháo cổ phiếu công nghệ và đặt dấu hỏi về quy mô chi tiêu AI tại Mỹ. Sau đó, công ty biến mức giảm giá 75% thành chính sách cố định, buộc hàng loạt đối thủ như Moonshot, MiniMax, Z.AI, ByteDance và Alibaba liên tục cắt giảm giá theo.
Đọc tiếp: Tin đồn iPhone gập trở nên cụ thể: 2.500 USD, không Face ID, không telephoto






