Moonshot AI vừa giới thiệu Kimi K3, mô hình open-weight với 2,8 nghìn tỷ tham số mà công ty khẳng định là lớn nhất hiện nay, với kết quả benchmark đưa nó tiệm cận nhóm hệ thống tiên phong tại Mỹ.
Điểm nhấn:
- Kimi K3 của Moonshot sở hữu 2,8 nghìn tỷ tham số và cửa sổ ngữ cảnh 1 triệu token, toàn bộ trọng số sẽ được mở ngày 27/7.
- Kiểm thử độc lập cho thấy mô hình có điểm số tiệm cận Opus 4.8 của Anthropic, chỉ xếp sau Fable 5 và GPT-5.6 Sol của OpenAI.
- Kimi K3 đang dẫn đầu bảng xếp hạng lập trình front-end trên Arena, trở thành lời thách thức mã nguồn mở sắc nét nhất của Trung Quốc tới nay.
Chi tiết ra mắt Kimi K3
Moonshot đã giới thiệu Kimi K3 ngày 16/7 thông qua ứng dụng và giao diện web của mình, đồng thời lên lịch công bố full open-weight vào ngày 27/7 theo một giấy phép sử dụng khá “thoáng”. Startup đặt trụ sở tại Bắc Kinh này, được hậu thuẫn bởi Alibaba, xây dựng Kimi K3 theo kiến trúc mixture-of-experts, trong đó chỉ có 16 trên tổng số 896 “expert” được kích hoạt cho mỗi token.
Cửa sổ ngữ cảnh 1 triệu token cho phép mô hình xử lý cả một codebase khổng lồ hoặc các bộ tài liệu dài chỉ trong một lượt, hướng đích trực tiếp tới mảng kỹ sư phần mềm và công việc tri thức. Hỗ trợ tự nhiên văn bản, hình ảnh và video giúp Kimi K3 trở thành bản phát hành được Moonshot mô tả là “mạnh nhất từ trước tới nay”. Quy mô 2,8 nghìn tỷ tham số cũng đưa Kimi K3 vượt xa DeepSeek V4 Pro – hiện quanh mức 1,6 nghìn tỷ tham số – trong khi mức giá trả phí bắt đầu từ 3 USD mỗi 1 triệu token đầu vào và 15 USD cho mỗi 1 triệu token đầu ra.
Moonshot đã khéo léo định vị màn ra mắt chỉ vài ngày trước Hội nghị Trí tuệ Nhân tạo Thế giới (WAIC) tại Thượng Hải, qua đó tranh ánh đèn sân khấu với các ông lớn toàn cầu.
Bài liên quan: Solana giành lại mốc 77 USD khi DEX tăng 4,15 tỷ USD thử thách đà tăng giá
Benchmark: tiệm cận nhóm tiên phong
Kết quả kiểm thử độc lập từ Artificial Analysis ghi nhận Kimi K3 đạt 57 điểm trên chỉ số “intelligence index” của đơn vị này – mức điểm sát với Opus 4.8 của Anthropic, dù vẫn đứng dưới Fable 5 và GPT-5.6 Sol của OpenAI. Trên một bộ benchmark khác mô phỏng các tác vụ công việc thực tế, Kimi K3 đứng thứ ba, vượt lên trên Opus 4.8. Cộng đồng lập trình trên Arena xếp hạng Kimi K3 vị trí số một cho bài toán lập trình front-end, trên toàn bộ các mô hình hàng đầu của Mỹ được đem ra so sánh.
Những bảng xếp hạng này mang ý nghĩa đáng kể bởi việc mở trọng số giúp nhà phát triển có thể tải mô hình về, tinh chỉnh và triển khai riêng, thay vì phải “thuê” qua API. Lợi thế cạnh tranh vì thế dần dịch chuyển từ chất lượng mô hình thuần túy sang bài toán hạ tầng rẻ hơn và khả năng phân phối rộng hơn. Với các đội ngũ đang xây dựng AI agent, một mô hình quy mô như Kimi K3 lại dùng giấy phép thoáng là bước gỡ nút thắt quen thuộc.
Moonshot và câu chuyện trở lại đường đua
Dù vậy, giới phân tích vẫn khuyến nghị thận trọng, bởi nhiều con số hiện vẫn do chính công ty cung cấp và dữ liệu kiểm thử độc lập còn hạn chế do thời gian ra mắt quá ngắn. Một lãnh đạo Moonshot ví số tham số như số lượng kết nối thần kinh trong não người, lập luận rằng càng nhiều “kết nối” thì mô hình càng có không gian lưu trữ và suy luận trên khối tri thức lớn hơn. Ngược lại, một số bên thử nghiệm lại ghi nhận tỷ lệ “ảo giác” (hallucination) cao hơn so với phiên bản Kimi trước đó.
Thương vụ ra mắt Kimi K3 cũng đánh dấu cú “lội ngược dòng” đáng chú ý cho Moonshot, sau giai đoạn 18 tháng hụt hơi khi DeepSeek vươn lên nắm thế thượng phong trong cộng đồng mã nguồn mở AI tại Trung Quốc. Dòng sản phẩm Kimi K2 trước đó chỉ đủ giữ tên tuổi Moonshot trong cuộc chơi, trước khi Kimi K3 giúp hệ sinh thái này rút ngắn đáng kể khoảng cách với các hệ thống độc quyền mà họ bị bỏ lại phía sau trong nhiều năm.
Bài nên đọc tiếp: SpaceX bốc hơi hơn 800 tỷ USD vốn hóa khi cổ phiếu rơi dưới giá IPO





