

DeepSeek官方公众号8月13日曾发布消息称,对DeepSeek API价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间9:00-12:00、14:00-18:00(其余为空闲时段)。新价格于北京时间8月17日00:00开始生效。
以旗舰模型DeepSeek-v4-pro为例,高峰时间段,V4 Pro每百万tokens输入(缓存未命中)9元,涨幅200%;输出27元,涨幅350%;缓存命中输入0.3元,涨幅1100%。空闲时间段,V4 Pro每百万tokens输入(缓存未命中)4.5元,输出13.5元,缓存命中输入低至0.15元。
DeepSeek-V4-Pro正式版于8月13日发布,该版本增强了智能体(Agent)能力。当时,DeepSeek-V -Pro价格是轻量级模型V4 Flash的大约三倍。以每百万tokens计算,V4 Pro输入是0.025元(缓存命中)和3元(缓存未命中),输出则是6元。相比之下,V4 Flash对应的价格分别为0.02元、1元和2元。
据了解,DeepSeek此次推出峰谷定价的核心初衷,是平衡日间算力拥堵问题。借助市场化价格杠杆,引导企业开发者错峰调度大模型任务,分流高峰算力压力,从而提升整体平台运行稳定性。
今年以来,DeepSeek多次发生服务异常,其中5月8日、21日、24日、28日连续崩溃,直接原因是用户量暴涨66.7%而算力储备仅增长8.3%,导致供需严重失衡。
华龙证券此前分析称,DeepSeek上调API定价,这标志着国产大模型长达一年的低价内卷正式告一段落,行业定价中枢进入修复通道,对算力、应用两端都将产生结构性影响。
在DeepSeek涨价之前,腾讯云、阿里云、百度智能云均已上调API算力产品价格。智谱年内已经三次上调API价格。
在2025年业绩说明会上,CEO张鹏曾表示,2026年一季度智谱的API调用定价提升83%,即便如此,市场依然呈现出供不应求的情况,调用量增长400%。当前,智谱已成为国内付费Token消耗量最高的厂商之一。
科技公司上调API价格,主要是因为在AI飞速发展的背景下,算力供给跟不上Token调用量的爆发式增长。
全球模型聚合平台OpenRouter最新周度Token调用榜单显示,8月3日至8月9日,全球AI大模型总调用量达到69万亿Token,较前一周增长21.48%。其中,中国AI大模型Token调用量达到34.25万亿,环比增长21.76%;美国AI大模凯云官网型Token调用量为9.17万亿,增长109.36%。这意味着,在OpenRouter这一平台上,中国AI模型调用量已经连续15周超过美国,稳居全球第一。
为了满足Token调用量,包括腾讯在内的很多公司豪掷巨资买算力。腾讯2026年二季度财报显示,该公司报告期内资本开支激增176%至527.8亿元,自由现金流为-138亿元—剔除AI算力采购预付款项后,才是正的376亿元。
腾讯总裁刘炽平表示,如果先用来自建模型、再用来开发应用、最后将算力对外出租的顺序推进,我们就能打造起一项极具规模的原生AI业务,这会带来非常可观的利润。
东方财富研究中心认为,算力供给的核心瓶颈在AI芯片。据IDC数据,2025年中国AI加速卡总出货量约400万张,其中国产卡约165万张,占比升至约41%。如今,国产替代更成为填补算力缺口的核心路径。