OpenAI周四大幅下调其GPT-5.6 Luna模型价格,输入/输出综合降幅达80%,中端模型Terra也降价约20%,背后是企业客户对AI使用成本的强烈反弹。
要点速览
- Luna现按每百万输入token 0.20美元、每百万输出token 1.20美元计费,较此前的1美元和6美元腰斩再腰斩。
- Terra下调至每百万输入token 2美元、每百万输出token 12美元,原价分别为2.50美元和15美元;旗舰Sol价格维持不变。
- 公司将降价主要归因于底层效率优化,包括由Sol团队推动的内核重写,将推理服务成本再压缩约20%。
GPT-5.6 Luna与Terra大幅降价
OpenAI在官网博文中披露了最新定价,并强调在模型架构、推理系统和服务端软件多层面的效率提升,是本轮降价的基础。
作为该系列中定位“高性能+高性价比”的快速模型,Luna目前按每百万输入token 0.20美元、每百万输出token 1.20美元计费,成为家族中最便宜的选择。中端Terra则降至每百万输入token 2美元、输出12美元,较此前2.50美元和15美元分别下调20%和20%。
高端旗舰模型Sol的token单价保持不变。OpenAI同时将此前的“优先处理”档位,调整为Sol的Fast模式,据外部报道,其推理速度最高可达标准模式的2.5倍,价格则为标准档的两倍。
面向终端用户的ChatGPT与开发者工具Codex订阅价未做调整。对于付费订阅客户而言,Luna与Terra本轮降价以“同样额度的配额可调用更多token”的方式体现。更新后的API价格同日已在AWS渠道陆续生效。
Notion与Dust:推理成本明显下降
OpenAI将Luna主要定位于高并发、高吞吐的企业场景,例如大规模文档分析、海量客服交互归类,以及在工具调用密集的智能体(agent)闭环中承担日常编码和测试工作。
按OpenAI自测数据,Luna在任务质量上接近一年前被视作“前沿级”的系统,但单位任务成本仅约当时的6%,推理速度则提升至约9倍。
多家首批企业用户在此次发布中给出类似的“算账结果”。Notion AI产品负责人Hoda Noorian表示,在特定约束任务上,Terra可在维持GPT-5.5质量水准的前提下,将成本压至一半、用时缩短约60%。Dust联合创始人Stanislas Polu则称,相较于公司此前默认模型,Luna在相同智能体任务上可实现约40%提速、同时成本降低约40%。
Anthropic与Google承压:token单价战打响
华尔街分析师对这轮价格战态度偏谨慎,部分机构警告,token单价的大幅下调虽然会刺激调用量上升,却可能在短期内挤压OpenAI与Anthropic的利润空间——两家公司均在6月提交了机密上市招股文件,资本市场对其盈利路径高度关注。
与此同时,Google和Microsoft已持续推出低价模型档位以争夺开发者与企业客户,而中国的一批开源/开权重大模型在性能上持续逼近海外头部产品,但价格只有其一小部分,进一步放大全球价格压力。
对算力成本的抱怨并非新鲜话题。OpenAI首席执行官Sam Altman在6月的一场客户活动中坦言,从几乎没人提,到成为“最大的痛点之一”,企业客户在短短数月内显著提高了对AI投入产出比的敏感度,要求OpenAI必须持续优化系统效率。
有代表性的案例是Uber:其2026年度AI预算仅用四个月就被花光,随后被迫在部分内部工具上引入分级计费方案,起步档位即为每月1500美元。





