Alibaba vừa giới thiệu một mô hình AI 2,4 nghìn tỷ tham số vào thứ Hai, kéo cổ phiếu niêm yết tại Hồng Kông tăng 7%, trong khi DeepSeek tung ra mức giá rẻ hơn Anthropic's Claude Fable 5 hơn 100 lần.
Các điểm chính:
- Qwen3.8-Max của Alibaba sở hữu tổng cộng 2,4 nghìn tỷ tham số, kích hoạt khoảng 95 tỷ tham số cho mỗi truy vấn, với bộ trọng số mở dự kiến công bố vào tuần tới.
- Cổ phiếu Alibaba tại Hồng Kông đóng cửa tăng 7%, trong khi chứng chỉ lưu ký tại New York tăng khoảng 4% trước giờ mở cửa.
- V4-Flash của DeepSeek chỉ tốn khoảng 3 cent cho mỗi bài kiểm thử chuẩn, so với 3,15 USD của Claude Fable 5.
Qwen3.8-Max giúp cổ phiếu Alibaba bứt phá
Tập đoàn có trụ sở tại Hàng Châu ra mắt Qwen3.8-Max vào thứ Hai và gọi đây là hệ thống mạnh nhất trong gia đình Qwen cho tới nay. Mô hình mang 2,4 nghìn tỷ tham số – các “thiết lập” mà hệ thống học được từ dữ liệu – và kích hoạt khoảng 95 tỷ tham số cho mỗi truy vấn. Cổ phiếu Alibaba tại Hồng Kông đóng cửa tăng 7%. Chứng chỉ lưu ký tại Mỹ tăng khoảng 4% trong phiên giao dịch trước giờ mở cửa ở New York.
Qwen3.8-Max xử lý văn bản, hình ảnh và video, với khả năng tiếp nhận cùng lúc tối đa 1 triệu token. Alibaba phát triển mô hình dựa trên kiến trúc Qwen3.5 trước đó, sử dụng thiết kế “hỗn hợp chuyên gia” (mixture-of-experts) chỉ đánh thức một phần mạng lưới cho mỗi yêu cầu, qua đó tiết kiệm tài nguyên tính toán.
Theo công ty, hệ thống này đã dành tới 16 ngày chỉ để tự xây dựng một công cụ dòng lệnh.
Qwen3.8-Max hiện là mô hình văn bản có thứ hạng cao nhất trong số các mô hình Trung Quốc trên Arena.AI, dù vẫn xếp sau Claude Fable 5 và ba biến thể Opus của Anthropic. Trên bảng xếp hạng các mô hình có khả năng đọc ảnh và dữ liệu thị giác khác, hệ thống này đạt vị trí thứ hai toàn cầu. Bộ trọng số mở sẽ được công bố vào tuần tới, lần đầu tiên cho một mô hình Qwen dòng Max. Alibaba dự định phát hành chúng trên Hugging Face và ModelScope.
Bài liên quan: Hạ tầng AI, cú xoay trục 1 tỷ USD tuyệt vọng của một nhà cho vay “payday” để thống trị trung tâm dữ liệu
DeepSeek V4-Flash “phá giá” Claude Fable 5
DeepSeek tung V4-Flash vào thứ Sáu, tính phí 0,14 USD cho mỗi triệu token đầu vào và 0,28 USD cho mỗi triệu token đầu ra. Artificial Analysis ước tính chi phí trung bình mỗi bài kiểm thử chỉ khoảng 3 cent, so với 0,86 USD của Kimi K3 do Moonshot AI phát triển, 1,86 USD với GPT-5.6 Sol của OpenAI và 3,15 USD với Claude Fable 5.
“Các công ty AI Trung Quốc đã tìm thấy một thị trường rất quan trọng,” Lian Jye Su, nhà phân tích trưởng tại hãng nghiên cứu Omdia, nhận định, cho rằng phần lớn quy trình làm việc trong doanh nghiệp chỉ cần một hệ thống đủ rẻ và dễ tiếp cận, thay vì luôn phải chọn mô hình dẫn đầu bảng xếp hạng.
Cuộc chiến giá AI tại Trung Quốc đang tái định hình kinh tế mô hình
Việc công bố trọng số mở cho phép nhà phát triển tải về toàn bộ “thiết lập” phía sau mô hình và hiệu chỉnh lại theo nhu cầu, một hướng đi mà tới nay Anthropic, OpenAI và Google vẫn chưa chấp nhận. V4-Flash đạt điểm 50/100 trên chỉ số Artificial Analysis Intelligence Index, tương đương Gemini 3.6 Flash của Google.
Kimi K3 đạt 57 điểm, trong khi các hệ thống đầu bảng của Anthropic và OpenAI cao hơn khoảng 9 điểm nữa. Đổi lại, mô hình giá rẻ này có xu hướng “nói nhiều”, tạo ra lượng token gấp khoảng hai lần mức trung vị trong quá trình kiểm thử.
DeepSeek từng gây chấn động toàn cầu vào đầu năm 2025, khi các mô hình R1 và V3 của hãng kích hoạt làn sóng bán tháo cổ phiếu công nghệ và làm dấy lên hoài nghi về mức chi tiêu khổng lồ của Mỹ cho AI. Công ty sau đó biến mức giảm giá 75% thành chính sách vĩnh viễn, và các đối thủ như Moonshot, MiniMax, Z.AI, ByteDance và Alibaba liên tục phải điều chỉnh giảm giá theo.
Bài tiếp theo: Tin đồn iPhone gập đi vào chi tiết: 2.500 USD, không Face ID, không camera tele






