8月17日,DeepSeekAPI开始执行新的价格标准。
信息源自DeepSeek的官方公众号。该公众号在8月13日发布通知,宣布DeepSeek API的定价策略将进行调整,引入峰谷模式,非高峰时段的定价会是高峰时段的一半。具体的高峰时段设定为北京时间9:00至12:00,以及14:00至18:00,其他时段都属于空闲时段。这一新定价方案自北京时间8月17日凌晨0点起正式实施。
以顶级的DeepSeek-v4-pro模型作为例子,高峰时段的价格为:每百万个tokens进行输入(假设缓存未命中),费用为9元,是原价的200%提升;输出费用为27元,涨幅达到350%;若输入时缓存命中,则费用为0.3元,涨幅高达1100%。空闲时段的价格则减半:每百万个tokens输入(缓存未命中)4.5元;输出费用为13.5元;输入时缓存命中的费用降至0.15元。
DeepSeek-V4-Pro的标准版在8月13日发布,这次更新强化了智能体的能力。在发布时的定价是较轻量级模型V4 Flash的三倍左右。以每百万tokens来计算,V4 Pro的输入成本(缓存未命中)为3元,而输出成本为6元。相比之下,V4 Flash的相应价格分别为输入0.02元(缓存命中)和1元(缓存未命中),输出成本为2元。
据了解,DeepSeek实施峰谷定价的主要目的是解决日间算力供给紧张的问题。通过价格的市场化引导,促使企业开发者调整任务执行时间,减轻高峰时段的算力压力,进而提升平台整体的运行效能。
今年内,DeepSeek曾多次出现服务中断的情况,例如5月8日到28日期间,连续四次崩溃。根本原因在于用户数量增加了66.7%,而算力储备的增长仅8.3%,造成了供给与需求的严重不平衡。
华龙证券此前分析,DeepSeek调高API价格,代表着国产大模型持续一年的低价竞争阶段已经结束,行业价格水平正在进入调整恢复的时期,这对算力供给和应用程序开发都将产生深远的结构性影响。
在DeepSeek调整价格之前,腾讯云、阿里云和百度智能云均提高了其API算力的价格。智谱也曾在一年内三次调整API的定价。
在智谱2025年的业绩沟通会议上,智谱的CEO张鹏透露,2026年第一季度智谱的API调用价格将提高83%,即便如此,市场依旧显示出供不应求的趋势,调用量的增长达到了400%。目前,智谱已经成为国内消费付费Token数量最多的公司之一。
科技企业提高API价格,很大程度上是因为在AI技术快速进步的背景下,算力的供给无法跟上Token调用量急剧增长的需求。
全球模型聚合平台OpenRouter最近一周的Token调用排行榜显示,从8月3日到8月9日,全球AI大模型的调用总量达到了69万亿Token,较前一周增长了21.48%。在中国AI大模型方面,Token调用量达到34.25万亿,环比增长21.76%;美国AI大模型的Token调用量为9.17万亿,增长了109.36%。这意味着在中国AI模型的调用量已经连续15周超越美国,稳定保持全球首位。
这个排行榜显示,从8月3日到8月9日,全球调用量最高的前四名AI大模型均来自中国。排名第一的是DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版),该周的Token调用量达到8.83万亿,环比暴增了570%;腾讯的Hy3模型位列第二,周调用量为8.05万亿,环比增长了67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)处于第三位,周调用量为5.88万亿,环比下降了19%;小米的MiMo-V2.5以5.39万亿Token排在第四位,与上一周相比调用量下降了14%。
为了满足Token调用的需求,包括腾讯在内的多家公司都在大量投资购买算力。根据腾讯2026年第二季度的财务报告显示,该公司在该季度报告期的资本支出










网友评论