阿里巴巴週一發表參數規模達 2.4 兆的大型 AI 模型,帶動港股股價勁揚 7%。同日,DeepSeek以超過百倍的價格優勢,將 Anthropic 的 Claude Fable 5 壓到角落。
重點整理
- 阿里巴巴 Qwen3.8-Max 具備 2.4 兆總參數,每次查詢約啟用 950 億參數,開源權重預計下週釋出。
- 阿里巴巴港股收盤大漲 7%,紐約掛牌美國存託憑證開盤前亦漲約 4%。
- DeepSeek V4-Flash 每次基準測試成本約 0.03 美元,對比 Claude Fable 5 的 3.15 美元。
阿里巴巴 Qwen3.8-Max 登場 股價應聲齊揚
這家總部位於杭州的公司週一 發表 新一代旗艦模型 Qwen3.8-Max,並稱其為「Qwen 家族迄今最強」系統。該模型具備 2.4 兆總參數——亦即從數據中學習而來的權重設定——實際推理時,每次查詢約會啟用 950 億參數。
受利多激勵,阿里巴巴港股當日收盤 上漲 7%。紐約市場方面,其美國存託憑證盤前約漲 4%。
Qwen3.8-Max 支援文字、圖片與影片多模態輸入,單次可處理長達 100 萬個 token。該模型延續 Qwen3.5 架構,採用「專家混合」(Mixture of Experts, MoE)設計,推理時只喚醒部分子網路,以兼顧效能與成本。
阿里巴巴表示,這套系統曾單獨花費 16 天時間,自行開發 一套命令列工具,展現其長周期任務能力。
在 Arena.AI 的文字模型評測榜單上,Qwen3.8-Max 為「中國系」模型中的最佳表現者,但整體仍落後於 Anthropic 的 Claude Fable 5 與三款 Opus 變體。至於圖像與其他視覺輸入模型的全球排行榜上,該系統則名列第二。
阿里巴巴預計下週開放 Qwen3.8-Max 權重,將成為首款釋出完整權重的 Qwen 「Max」級模型,並計畫在 Hugging Face 與 ModelScope 上架。
延伸閱讀: AI 基礎建設:發薪日貸款商豪砸 10 億美元搶攻資料中心
DeepSeek V4-Flash 重砍價格 挑戰 Claude Fable 5
DeepSeek 於上週五推出新模型 V4-Flash,定價為每百萬輸入 token 0.14 美元、每百萬輸出 token 0.28 美元。研究機構 Artificial Analysis 估算,在其標準化測試中,V4-Flash 平均每次成本約 0.03 美元,遠低於 Moonshot AI Kimi K3 的 0.86 美元、OpenAI GPT-5.6 Sol 的 1.86 美元,以及 Claude Fable 5 的 3.15 美元。
「中國 AI 公司已經找到一個關鍵市場。」研究機構 Omdia 首席分析師 Lian Jye Su 指出,許多企業工作流程其實只需要「用得起、用得到」的系統,高性價比比追求極致性能更為重要。
陸系 AI 價戰 重塑大模型經濟學
所謂「開源權重」,是指開放模型背後的參數設定,讓開發者可下載後自行微調與部署。這條路徑迄今仍非 Anthropic、OpenAI 與 Google 的主流選擇。
在 Artificial Analysis 的 Intelligence Index 評測中,V4-Flash 拿下 50 分,與 Google 的 Gemini 3.6 Flash 不相上下。Kimi K3 則達到 57 分,而 Anthropic 與 OpenAI 的旗艦模型大致再高出約 9 分。
不過,V4-Flash 在測試中輸出特別「健談」,產生的 token 數量約為整體中位數的兩倍,等於用便宜的單價換取更長內容。
DeepSeek 在 2025 年初便曾重創全球科技股:其 R1 與 V3 模型橫空出世,市場開始質疑美國在 AI 投資上的「性價比」。該公司其後將臨時降價變為常態,宣布把價格永久下調 75%。自那之後,包括 Moonshot、MiniMax、Z.AI、字節跳動與阿里巴巴在內的競爭者紛紛跟進,不斷下修模型價格。






