作者|唐飞
编辑|李小天
2026年7月末至8月初,全球AI领域发生了一件不同寻常的事。
一边是OpenAI,突然宣布对轻量级模型Luna进行大幅度降价,价格削减高达80%。输入成本从每百万Token 1美元降至0.2美元,输出成本也从6美元调整为1.2美元。中端模型Terra也同步下调20%价格,而旗舰级Sol保持不变。
另一边,DeepSeek这家被开发者称为“Token价格屠夫”的中国公司发布公告,表示将不久后整体提高API服务费用,“预估增长率显著”。
一降一升,形成了鲜明对比。
事情并非偶然。这两件事在不到十天之内相继出现,反映出中美两国企业在AI战略上的明显差异——美国企业正通过分层定价构建防御策略,中国企业则借助性价比优势在全球市场上争夺定价权。
一组数据,可以看清中美定价策略的差距
美国头部大模型企业纷纷推出降价举措。
先来看OpenAI的操作,7月,该公司围绕GPT-5.6完成了产品与价格的全面调整,首次在同一代产品中建立起Sol、Terra、Luna三层体系,并且在产品上线仅三周就迅速实施结构性降价。
具体分析Sol(旗舰级)维持原价(输入成本30.00每百万Token),Terra(中端)价格下调20%(调整后输入成本12.00),Luna(轻量级)大幅度削减80%(调整后输入成本1.20)。此外,还为Sol推出双倍价格的Fast加速模式,该模式将处理速度提升至标准模式的2.5倍。整个调整过程明显比以往更快,显示出明显的竞争应对倾向。
这一三层结构标志着OpenAI不再依赖单一旗舰模型覆盖全部市场,而是转向构建更贴近企业预算管理的分级供应体系。Sol定位为旗舰前沿能力,主要面向复杂推理、科研、长程Agent等高风险场景,维持原价是为了保留OpenAI的能力溢价、利润基准与品牌上限。同步推出的Fast模式则将时延从服务属性分离为可单独销售的商品,让旗舰层的商业逻辑从单一能力溢价,扩展为能力与时延的双重溢价。Terra定位为日常生产主力,负责将原本在Sol上运行的中等复杂度请求转移至更低成本层,既可以减少客户总体支出,也能提高体系内的路由效率,是整个经营模式的核心。Luna则针对高并发量,服务分类、摘要、提取、轻量Agent等高吞吐量且价格敏感的任务,大幅降价后直接进入超低价市场,与中国厂商的高性价比模型展开竞争。
除了GPT-5.6降价外,8月10日,Anthropic取消了Claude Sonnet 5原定于9月实施的50%涨价计划。
资料显示,Sonnet 5在6月底发布时的API首发价为每百万Token输入2美元、输出10美元,原计划9月1日恢复至3美元和15美元。最新消息显示,这一涨价计划已被取消,2美元/10美元的定价将继续适用。
新发布的谷歌Gemini 3.7 Flash也提供了优惠价格。根据官方公布的信息,这款模型的输入Token成本为每百万0.75美元,输出Token成本为每百万3.75美元,相当于上一版本原有标准价格的五折。
并且这一价格策略并非短期措施,将一直有效至2027年1月1日,给市场留下了数月的低价期。
但中国的大模型企业则呈现出不同的趋势。
DeepSeek是其中之一,8月11日,该公司在官方API定价页面预告将很快整体提高费用,并提示“预计涨幅较大”。
8月12日晚上,DeepSeek V4 Pro正式版开始提供服务。从定价角度看,以每百万tokens计算,V4 Pro的输入成本为









网友评论