Qwen與DeepSeek狂飆 中國AI估值直逼Anthropic門口

Rival launches from Alibaba and DeepSeek reset AI pricing, with Qwen3.8-Max and V4-Flash chasing Anthropic's Claude Fable 5. (Image: Shutterstock)
Rival launches from Alibaba and DeepSeek reset AI pricing, with Qwen3.8-Max and V4-Flash chasing Anthropic's Claude Fable 5. (Image: Shutterstock)

阿里巴巴週一發布參數規模高達 2.4 兆的最新大模型,帶動港股股價勁揚 7%。同時,DeepSeek以不到 Anthropic Claude Fable 5一百分之一的成本, 推出新一代平價模型,正面挑戰美系龍頭。

重點摘要:

  • 阿里巴巴 Qwen3.8-Max 採混合專家架構,總參數 2.4 兆,每次推理啟用約 950 億參數,權重預計下週開源。
  • 阿里港股收盤大漲 7%,紐約掛牌美國存託憑證(ADR)盤前一度上漲約 4%。
  • DeepSeek V4-Flash 每次基準測試成本約 0.03 美元,遠低於 Claude Fable 5 的 3.15 美元。

阿里巴巴 Qwen3.8-Max 登場 股價應聲走高

阿里巴巴總部所在地杭州周一宣布推出 Qwen3.8-Max,並稱其為迄今 Qwen 家族中最強模型。該系統具備 2.4 兆總參數——亦即模型從數據中學習到的權重設定—— 但每次推理僅啟用約 950 億參數,以提升效能與成本效率。消息公布後,阿里港股收盤上漲 7%, 紐約掛牌 ADR 盤前也上漲約 4%。

Qwen3.8-Max 支援文字、圖像與影片輸入,單次可處理多達 100 萬個 token,明顯瞄準長上下文應用場景。該模型建立在先前 Qwen3.5 架構之上,採用「混合專家」(Mixture-of-Experts, MoE)設計,每次只喚醒部分子網路,以在性能與算力成本間 取得平衡。

依阿里對外說明,模型在內部測試中,曾花費 16 天時間,獨力開發並優化一套命令列工具,凸顯其在長期任務與工具使用方面的 能力。

在第三方評測平台 Arena.AI 上,Qwen3.8-Max 已躋身文字模型榜單中表現最佳的中國模型,不過整體表現仍落後於 Claude Fable 5,以及 Anthropic 的三款 Opus 旗艦變體。在支援圖像等多模態輸入的模型排行榜上,Qwen3.8-Max 則躍居全球第二名,僅次於國際頂級對手,表現引人關注。最新排行顯示, 該模型的視覺理解能力已站上全球第一梯隊。

阿里預計於下週釋出 Qwen3.8-Max 的開放權重,這將是 Qwen「Max 級」產品首度公開權重,並計畫同步上架 Hugging Face 與 ModelScope,供開發者下載微調,擴大生態圈。

延伸閱讀:AI 基礎設施:發薪日貸款商豪砸 10 億美元,鋌而走險押注資料中心轉型

DeepSeek V4-Flash:以「地板價」挑戰 Claude Fable 5

DeepSeek 於上週五推出 V4-Flash 模型,定價策略極具殺傷力:輸入每百萬 token 收費 0.14 美元,輸出每百萬 token 則為 0.28 美元。第三方研究機構 Artificial Analysis估算, 以標準化基準測試計算,V4-Flash 平均每次測試成本僅約 0.03 美元,明顯低於中國同業 Moonshot AI 的 Kimi K3(0.86 美元)、OpenAI GPT-5.6 Sol(1.86 美元),以及 Anthropic 的 Claude Fable 5(3.15 美元)。

「中國 AI 廠商已經找到了關鍵市場切入點。」研究機構 Omdia 首席分析師 **蘇連傑(Lian Jye Su)**表示, 對多數企業來說,AI 只要「夠用且價格可負擔」,就足以導入到大量實際工作流程中,未必需要最頂規、最昂貴的模型。

中國 AI 價格戰 重塑大模型商業邏輯

所謂「開放權重」,是指廠商向外釋出模型訓練後的完整參數設定,讓開發者可下載並在本地或私有雲環境中進行微調與二次開發。 相較之下,Anthropic、OpenAI 與 Google 至今仍以封閉 API 為主,尚未在旗艦產品上走向開放權重路線。

從效能來看,V4-Flash 在 Artificial Analysis 的 Intelligence Index 上取得 50 分(滿分 100 分),與 Google 的 Gemini 3.6 Flash 打成平手。Moonshot 的 Kimi K3 則拿到 57 分,而 Anthropic 與 OpenAI 的旗艦模型,普遍再高出約 9 分,顯示高階模型在綜合能力上仍具一定領先。

不過,V4-Flash 的回應風格偏向詳盡冗長,在測試中輸出的 token 數量約為同場模型中位數的兩倍,代表其在相同任務下 會產生更大量內容,對成本與使用體驗形成不同權衡。

DeepSeek 早在 2025 年初就曾吸引全球市場目光。當時,其 R1 與 V3 模型橫空出世,短時間內拖累科技股走勢,並引發 投資人對美國 AI 資本支出回報的疑慮。隨後公司將價格永久性下調 75%,迫使中國一眾競爭者跟進降價,包括 Moonshot、 MiniMax、Z.AI、字節跳動與阿里巴巴等,中國大模型市場從此進入「長期價格戰」格局。

在性能逼近、成本卻大幅下探的情況下,中國 AI 廠商正重新定義大模型的經濟學:美系封閉高價模式,正遭到開放權重、 極致低價策略的正面挑戰。

下一篇:摺疊版 iPhone 傳聞曝光:售價 2,500 美元、取消 Face ID、無望望遠鏡頭

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev 是 Yellow.com 的內容總監,過去 10 年持續報導加密貨幣領域。他專長於撰寫深入的 Research 和 Learn 類型文章,特別關注分析式報導、產業脈絡,以及塑造加密貨幣世界的更大力量,從 AI 時代與資安技術到金融科技創新。他相信數位的一切即將全面超越類比的一切,並正為實現這一願景而全力以赴。

免責聲明與風險警告: 本文提供的資訊僅供教育與參考用途,並基於作者觀點,不構成財務、投資、法律或稅務建議。 加密貨幣資產具有高度波動性並伴隨高風險,包括可能損失全部或大部分投資金額。買賣或持有加密資產可能並不適合所有投資者。 本文中所表達的觀點僅代表作者立場,不代表 Yellow、其創辦人或管理層的官方政策或意見。 請務必自行進行充分研究(D.Y.O.R.),並在做出任何投資決策前諮詢持牌金融專業人士。
Qwen與DeepSeek狂飆 中國AI估值直逼Anthropic門口 | Yellow