DeepSeek 周四向开发者发出预警,称其 API 服务价格将在不久后“大幅上调”,这意味着这家以每百万输入 token 收费 0.14 美元“卷穿全场”的公司即将扭转低价策略。
要点速览:
- DeepSeek 通知用户,其 API 价格将显著上调,但未披露具体数值或生效日期。
- 目前 V4 Flash 每百万输入 token 收费 0.14 美元、输出 token 收费 0.28 美元,远低于西方主要对手。
- 涨价预警紧随 V4-Flash-0731 需求创纪录及其在内蒙古建设大型数据中心计划之后。
DeepSeek 发布 API 涨价预告
这家总部位于杭州的公司在其开发者平台发布公告,但未给出任何具体数字、涨幅比例或生效时间表。
公告仅称整体定价将在“近期”上调,详细方案稍后公布,并提醒客户“提前规划使用”,但这一表述并未透露涨价的实际尺度。
按照目前官方公布标准,V4 Flash 每百万输入 token 收费 0.14 美元、输出 token 收费 0.28 美元,价格几乎是主流市场的一个数量级以下。对比之下,Moonshot AI 的 Kimi K3 同等规模分别收费 3 美元和 15 美元,而 Anthropic 在其 Fable 5 服务上则标价 10 美元和 50 美元。
此次预警发布的时间点也颇为敏感:就在一周前,DeepSeek 刚刚推出 2,840 亿参数的大模型 V4-Flash-0731。该模型采用“激活子集参数”的架构设计,每次推理仅启用约 130 亿参数,从而将典型任务成本控制在约 0.03 美元左右。
延伸阅读:Airbnb 股价飙升 17% CEO 称 45% 客服问题已由 AI 自动解决
开发者质疑 DeepSeek 涨价时机
人工智能开发者 Michael Guo 在社交媒体上发文,质疑 DeepSeek 此时上调价格的决策,认为公司在“风口期”贸然提价,可能为自己埋下隐患。
他指出,美国多家实验室在成本和模型能力上,已大幅缩小与 DeepSeek 之间的差距。Meta 的 Muse Spark 以及 OpenAI 的 GPT-5.6 Luna,如今都在直接争夺同一批开发者预算。
各平台的使用数据也显示,V4 Flash 开放广泛可用后压力迅速放大。路由平台 OpenRouter 排名显示,在 7 月 27 日至 8 月 2 日这一周内,V4 Flash 以 7.22 万亿 token 的调用量位居首位,代码平台 OpenCode 也在 8 月 1 日单日记录调用量达 8 万亿 token。
DeepSeek 定价策略拐点浮现
如此规模的流量,对算力芯片及电力的消耗极为可观,长期维持“亏本价”愈发难以为继。DeepSeek 此前已披露,将在内蒙古建设大型数据中心,目标是为自身锁定约 1 吉瓦级别的算力保障。
按 Nvidia 首席执行官 黄仁勋 的测算,如此规模、并配备顶级加速器的数据中心,建设成本大致在 500 亿美元量级。
此次预告中的涨价,已经是 DeepSeek 一个月内第二次调整定价策略。就在 7 月中旬,DeepSeek 刚刚引入峰谷分时定价,以缓解业务高峰期的服务器压力。
在那之前,DeepSeek 还于 5 月对 V4 长期打折,迫使包括 字节跳动 和 腾讯 在内的多家国内对手下调官方标价,掀起一轮“AI 大模型价格战”。





