阿里巴巴周一发布参数规模达2.4万亿的通义大模型,带动其港股股价大涨7%;与此同时,DeepSeek新模型的调用成本较Anthropic的Claude Fable 5便宜逾百倍,中资AI厂商在性能与价格两端同步发力。
要点概览:
- 阿里发布的通义Qwen3.8-Max总参数达2.4万亿,每次调用实际激活约950亿参数,开放权重预计下周推出。
- 阿里港股收涨7%,其在纽约上市的美国存托凭证盘前涨约4%。
- DeepSeek的V4-Flash单次基准测试成本约0.03美元,而Claude Fable 5为3.15美元。
通义Qwen3.8-Max发布 股价应声走高
总部位于杭州的阿里巴巴周一发布最新一代通义模型Qwen3.8-Max,称其为通义家族迄今“综合能力最强”的系统。该模型总参数规模达2.4万亿——即从训练数据中学习到的权重配置——单次推理由“专家混合”(MoE)机制实际激活约950亿参数。阿里港股当日收盘上涨7%,纽约盘前美股存托凭证涨幅约4%。
Qwen3.8-Max支持文本、图像和视频多模态输入,单次可处理最高100万token上下文。该模型基于此前的Qwen3.5架构升级,采用“Mixture-of-Experts”设计,仅唤醒部分子网络参与计算,以在算力和性能间取得平衡。
阿里方面披露,Qwen3.8-Max曾在内部用于开发命令行工具,单一项目就连续运行了16天。
在评测平台Arena.AI的文本模型榜单上,Qwen3.8-Max已跃居“中文阵营”最高位,但总体仍落后于Anthropic的Claude Fable 5以及三款Opus系列模型。在支持视觉理解的多模态榜单上,该模型则位列全球第二。阿里计划于下周开放该模型权重,这将是通义“Max级”模型首次开放权重,预计将在Hugging Face与ModelScope平台同步发布。
延伸阅读: AI基础设施:现金贷巨头豪赌百亿美元,转身抢占数据中心
DeepSeek V4-Flash:对标Claude Fable 5的“骨折价”
DeepSeek上周五发布V4-Flash模型,定价为每百万输入token收费0.14美元、每百万输出token0.28美元。咨询机构Artificial Analysis测算,在标准测试场景下,V4-Flash单次评测平均成本约0.03美元;相比之下,**月之暗面(Moonshot AI)**的Kimi K3为0.86美元,OpenAI的GPT-5.6 Sol为1.86美元,而Claude Fable 5则高达3.15美元。
“中国AI公司已经找到一个关键市场定位。”研究机构Omdia首席分析师Lian Jye Su表示,许多企业工作流并不需要“顶配模型”,而更看重“够用且便宜、接入门槛低”的系统。
中资AI价格战重塑模型商业逻辑
所谓“开放权重”意味着开发者可直接下载模型的参数配置并进行本地或私有化微调,这一策略迄今尚未被Anthropic、OpenAI和Google采用。DeepSeek的V4-Flash在Artificial Analysis的“Intelligence Index”上得分为50分,与Google的Gemini 3.6 Flash处于同一档位。
Kimi K3得分57分,而Anthropic与OpenAI的旗舰级模型则普遍高出约9分。不过,V4-Flash在评测中生成内容更为冗长,平均输出token数量约为样本中位数的两倍,意味着在相同任务下可能产生更多字数的回答。
DeepSeek在2025年初凭借R1与V3模型一度引爆全球资本市场,当时的“价格屠夫”策略引发科技股抛售,也让外界重新审视美国在AI领域的高额投入。此后,DeepSeek将临时折扣转为永久,整体定价下调约75%。包括Moonshot、MiniMax、Z.AI、字节跳动以及阿里巴巴在内的一众竞争对手,也在此后持续下调模型推理价格。






