桃子桃子快讯
返回首页
行业动态

DeepSeek API 大幅调价生效:V4 Pro 缓存命中输入涨幅达 1100%

DeepSeek API 新定价 8 月 17 日生效,V4 Pro 缓存命中输入涨幅达 1100%,并首次推出峰谷分时…

2026.08.18 · 周二2 分钟阅读

8 月 17 日 0 时起,DeepSeek API 新定价正式生效。根据 DeepSeek 官方公众号 8 月 13 日 发布的消息,新方案采用峰谷分时定价机制,高峰时段为北京时间 9:00-12:00、14:00-18:00,其余时段为空闲时段,空闲时段价格为高峰时段的一半。

旗舰模型涨幅显著

以旗舰模型 DeepSeek-V4-Pro 为例,高峰时段每百万 tokens 的价格为:输入(缓存未命中)9 元,较此前上涨 200%;输出 27 元,涨幅 350%;缓存命中输入 0.3 元,涨幅 1100%。空闲时段对应价格分别为 4.5 元、13.5 元和低至 0.15 元。

相比 8 月 13 日 V4-Pro 正式版发布时的初始定价(输入 3 元/百万 tokens 缓存未命中、0.025 元缓存命中,输出 6 元/百万 tokens),新方案的整体价格水平明显抬升,其中缓存命中输入涨幅最为突出。

V4 Pro 与 V4 Flash 价差扩大

在 DeepSeek 自家模型矩阵中,V4 Pro 定价约为轻量级模型 V4 Flash 的三倍。以每百万 tokens 计:

  • V4 Pro:输入 0.025 元(缓存命中)、3 元(缓存未命中),输出 6 元
  • V4 Flash:输入 0.02 元(缓存命中)、1 元(缓存未命中),输出 2 元

新方案下 V4 Pro 涨幅远高于 V4 Flash,两者的价差进一步拉大,体现出 DeepSeek 对高阶模型算力成本的回收诉求。

峰谷定价的设计逻辑

DeepSeek 表示,推出峰谷定价的核心初衷是平衡日间算力拥堵问题:借助市场化价格杠杆,引导企业开发者将大模型任务向非高峰时段迁移,分流高峰算力压力,从而提升平台整体运行稳定性。这与云算力领域常见的错峰调度思路类似,在大模型 API 服务中尚属较新的尝试。

对开发者的影响

缓存命中输入涨幅 1100% 是本次调价中最受关注的一项。对于长上下文、检索增强生成(RAG)等高度依赖缓存命中的业务场景,成本上升压力相对更大;而主要集中在空闲时段调用 API 的工作负载,则可借助折扣维持原有成本水平。开发者需要重新评估调用时段与缓存策略,以应对新的价格结构。

信源