DeepSeek API引入“峰谷定价”:闲时半价,高峰翻倍,8月17日生效
曾以“价格屠夫”姿态搅动大模型市场的DeepSeek,正式放下了“砍刀”。
8月13日,深度求索官方宣布将对DeepSeek API价格进行更新调整,采用峰谷定价模式,空闲时段价格为高峰时段价格的一半。新价格将于北京时间2026年8月17日00:00正式生效。
定价重构:闲时省钱,高峰“肉疼”
根据官方公布的方案,高峰时段定为北京时间每日9:00-12:00和14:00-18:00,其余时段均为空闲时段。
具体价格调整如下:
deepseek-v4-flash模型:
· 空闲时段:输入(缓存命中)0.05元/百万tokens,输入(缓存未命中)1.5元/百万tokens,输出4.5元/百万tokens
· 高峰时段:输入(缓存命中)0.1元/百万tokens,输入(缓存未命中)3元/百万tokens,输出9元/百万tokens
deepseek-v4-pro模型:
· 空闲时段:输入(缓存命中)0.15元/百万tokens,输入(缓存未命中)4.5元/百万tokens,输出13.5元/百万tokens
· 高峰时段:输入(缓存命中)0.3元/百万tokens,输入(缓存未命中)9元/百万tokens,输出27元/百万tokens
对比此前DeepSeek V4 Pro缓存命中输入仅0.025元/百万tokens、输出6元/百万tokens的“地板价”,高峰时段调用成本最高涨幅达4.5倍。
告别“价格战”:算力承压下的必然选择
这一调整并非突然。8月6日,DeepSeek就已发布预告,称“计划近期整体上调API服务定价,预计涨幅较大”。彼时已在开发者社区激起不小波澜。
算力成本压力是直接推手。 进入2026年,大模型调用量呈指数级增长。据第三方数据,仅8月1日一天,DeepSeek-V4-Flash在其平台上的Token处理量就冲到8万亿。智能体(Agent)的大规模落地,单次任务算力消耗可达普通对话的百倍,对GPU算力、集群运维构成巨大压力。
另一方面,国产大模型行业正集体告别“流血换规模”阶段。今年以来,智谱、月之暗面等均已多次上调API价格,行业竞争正从价格战转向商业可持续性的多维较量。
开发者如何应对?
峰谷定价机制为开发者提供了明确的成本优化路径:高并发、非实时任务可转移至空闲时段处理,以享受半价优惠;实时交互类业务则需将峰时成本纳入核算。
有分析指出,这一机制实际上是算力资源稀缺背景下的标准化调度工具,而非单纯的涨价。高盛在7月研报中也认为,DeepSeek实施峰谷定价不意味着需求走弱,反而反映出国内AI模型需求持续旺盛、算力资源趋紧。
AI低价红利时代正在落幕。对于依赖API生态的中小开发者而言,建立模型分层、动态路由和错峰调度机制,将成为新的生存必修课。
