8月17日0时,深度求索(DeepSeek)官方公告,DeepSeek-V4系列API全新定价正式生效,同时V4-Pro结束测试阶段,全面转为正式版商用服务。本次调价取消统一计费模式,采用行业少见的算力错峰分级计价,高峰时段收费标准较空闲时段直接翻倍。

DeepSeek官方划定高峰时段为每日北京时间9:00-12:00、14:00-18:00,其余时间为空闲时段。空闲时段定价为高峰时段的一半,计费单位为元/百万tokens。
这一定价策略在AI大模型API领域较为罕见。此前,OpenAI、Anthropic等厂商主要采用固定费率或按量阶梯折扣模式,DeepSeek率先引入"电力式"峰谷定价,意在引导用户错峰调用,缓解算力资源在高峰时段的集中压力。
根据涨价前后对比数据,V4-Pro部分项目涨幅惊人:

缓存命中输入价格方面,涨价前为0.025元/百万tokens,高峰时段涨至0.30元,涨幅高达1100%;空闲时段为0.15元,涨幅500%。缓存未命中输入价格从3元涨至高峰时段9元(涨幅200%),空闲时段4.5元。输出价格从6元涨至高峰时段27元(涨幅350%),空闲时段13.5元。
V4-Flash方面,缓存命中输入从0.02元涨至高峰时段0.10元(涨幅400%),空闲时段0.05元。缓存未命中输入从1元涨至高峰时段3元(涨幅200%),空闲时段1.5元。输出从2元涨至高峰时段9元(涨幅350%),空闲时段4.5元。
8月12日晚,DeepSeek悄然上线V4-Pro正式版,结束了此前的测试阶段。V4-Pro是DeepSeek-V4系列中的高端型号,面向对推理质量和稳定性要求更高的企业级客户。此次调价同步伴随正式版商用,意味着DeepSeek正在从"低价获客"阶段转向"商业化变现"阶段。

DeepSeek此次大幅调价,反映出国产大模型行业正经历从"烧钱换量"到"追求可持续盈利"的深刻转变。
一方面,AI算力成本持续高企。随着模型规模扩大和推理需求爆发,GPU集群的运营成本、电力成本、数据中心建设成本均在快速上升。即便是以"极致性价比"著称的DeepSeek,也难以长期维持此前的低价策略。
另一方面,峰谷定价是一种精细化的资源调度手段。通过价格杠杆引导用户在非高峰时段调用API,可以在不增加硬件投入的情况下,提升整体算力利用率,降低单位token的边际成本。这与电力行业的峰谷电价逻辑如出一辙。
对于依赖DeepSeek API的开发者而言,此次调价意味着成本结构的重构。以V4-Pro高峰时段缓存命中输入为例,价格从0.025元暴涨至0.30元,涨幅11倍——对于高频调用、缓存命中率高的应用场景(如客服机器人、内容生成等),成本压力将显著增加。
应对策略可能包括:调整业务逻辑,将批量任务调度至空闲时段执行;优化缓存策略,提高缓存命中率以降低成本;或者评估是否需要切换至V4-Flash等相对低价的模型版本。
DeepSeek的涨价并非孤例。今年以来,随着存储、算力等成本全面上涨,多家AI厂商已调整定价策略。此前,OpenAI、Anthropic等也在逐步优化其定价结构,推动高价值客户向更高阶的模型版本迁移。
DeepSeek作为国产大模型"性价比之王",其涨价具有标志性意义——它意味着即便是以低价策略快速获取市场份额的厂商,也不得不面对成本现实,向可持续的商业模型回归。对于整个行业而言,这或许是大模型API"低价时代"逐步落幕的信号。
来源:电子工程专辑