阿里巴巴周一發佈擁有 2.4 兆參數的新一代大型語言模型,刺激其港股股價急升 7%,同日 DeepSeek 則以超過一百倍的價格優勢壓過 Anthropic 的 Claude Fable 5,將中國 AI 競爭推向國際龍頭門前。
重點概要:
- 阿里新模型 Qwen3.8-Max 總參數達 2.4 兆,每次查詢實際啟動約 950 億參數,開源權重預計下周公布。
- 阿里港股收市升 7%,紐約掛牌美國預託證券盤前亦升約 4%。
- DeepSeek 的 V4-Flash 每次基準測試成本約 0.03 美元,遠低於 Claude Fable 5 的 3.15 美元。
阿里推通義千問 Qwen3.8-Max 股價應聲急升
阿里巴巴在杭州總部周一發佈通義千問系列中迄今最強版本 Qwen3.8-Max。新模型總參數規模達 2.4 兆(trillion),即系統從海量數據中學習而來的設定值,每次回答查詢時實際啟用約 950 億參數。
消息公佈後,阿里巴巴港股收市急升 7%,紐約上市的美國預託證券在盤前交易亦上揚約 4%。
Qwen3.8-Max 支援文字、圖像及影片輸入,單次可處理長達 100 萬 token 的內容。阿里指,新模型建立在早前的 Qwen3.5 架構之上,採用「專家混合」(mixture-of-experts)設計,按需喚醒部分子網絡應答,以在效能與成本之間取得平衡。
公司披露,系統曾花費約 16 日時間,自行完成一套命令列工具的開發過程,展示其在長週期任務上的能力。
在測試平台 Arena.AI 的文字模型排名中,Qwen3.8-Max 是得分最高的中國模型,但整體仍落後於 Anthropic 的 Claude Fable 5 及其三個 Opus 變體。在可讀取圖像等視覺資料的多模態排行榜上,該模型則躋身全球第二名(排名)。
阿里計劃於下周釋出 Qwen3.8-Max 的開源權重,這亦是通義千問 Max 級別模型首次公開權重,並會在 Hugging Face 及 ModelScope 上發佈。
延伸閱讀:AI 基建:發薪貸款商孤注一擲撥 10 億美元轉戰數據中心
DeepSeek V4-Flash 超低價硬撼 Claude Fable 5
DeepSeek 上周五推出 V4-Flash 模型,定價為每百萬輸入 token 收費 0.14 美元,每百萬輸出 token 收費 0.28 美元。研究機構 Artificial Analysis 估算,其在標準測試中的平均成本約為每次 0.03 美元,明顯低於 Moonshot AI 的 Kimi K3(0.86 美元)、OpenAI 的 GPT-5.6 Sol(1.86 美元),以及 Claude Fable 5 的 3.15 美元。
研究公司 Omdia 首席分析師 Lian Jye Su 指出:「中國 AI 公司已找到一個關鍵市場。」他表示,許多企業實際業務流程只需要「夠用、夠平、易接入」的系統,未必一定追求最頂級性能。
中國 AI 價格戰重塑模型經濟學
開源權重讓開發者可直接下載模型的參數設定,自行微調和部署。迄今為止,Anthropic、OpenAI 與 Google 等美國巨頭仍未採取類似策略。DeepSeek 的 V4-Flash 在 Artificial Analysis 的 Intelligence Index 上取得 100 分滿分中的 50 分,與 Google 的 Gemini 3.6 Flash 成績相若。
Kimi K3 得分為 57 分,而 Anthropic 與 OpenAI 旗下旗艦模型則高出約 9 分。不過,V4-Flash 在測試中輸出的內容較為冗長,其生成的 token 數量約為整體中位數的兩倍,意味在實際應用中有可能推高總成本。
DeepSeek 早在 2025 年初已備受全球市場關注,其 R1 和 V3 模型曾一度引發科技股拋售,市場開始質疑美國在 AI 投資上的回報與投入規模是否匹配。其後公司將價格「腰斬再腰斬」,永久性調低約 75%,迫使 Moonshot、MiniMax、Z.AI、字節跳動及阿里巴巴等競爭對手持續跟進減價。






