DeepSeek API峰谷定价今日生效:高峰时段价格翻倍
来源:互联网DeepSeek API于2026年8月17日零点起正式实施峰谷定价方案,高峰时段价格为空闲时段的两倍,这一调整覆盖DeepSeek全新发布的V4系列商用模型,包括轻量高并发的DeepSeek-V4-Flash和旗舰级的DeepSeek-V4-Pro,两款模型均支持384K超长上下文窗口。
峰谷时段划分与价格变化
根据深度求索官方公布的正式方案,高峰时段精准划定为北京时间每日9:00-12:00、14:00-18:00,其余所有时段均为空闲时段——包含午间12:00-14:00、18:00之后的夜间时段、凌晨全时段,以及周末和法定节假日全天。
本次定价完全按照“高峰双倍、空闲半价”的规则设计,两款模型的完整定价如下:
DeepSeek-V4-Flash高峰时段,缓存命中输入0.10元/百万tokens、缓存未命中输入3.0元/百万tokens、输出9.0元/百万tokens;空闲时段对应价格直接减半,分别为0.05元、1.5元、4.5元。
DeepSeek-V4-Pro高峰时段,缓存命中输入0.30元/百万tokens、缓存未命中输入9.0元/百万tokens、输出27.0元/百万tokens;空闲时段对应价格同样减半,分别为0.15元、4.5元、13.5元。

计费规则与缓存折扣
所有公示价格均以人民币计价,不含额外税费,按实际调用的Token量计费。深度求索同步优化了缓存计费规则:针对高频重复输入的场景,命中缓存的输入部分执行专属低价,相比缓存未命中的输入成本大幅降低,输出部分不参与缓存折扣,按对应时段的输出单价全额计费。
以DeepSeek-V4-Pro为例,高峰时段命中缓存的输入仅需0.3元/百万tokens,空闲时段低至0.15元/百万tokens,对于代码审查、长文档迭代等重复调用相同上下文的场景,能大幅压缩成本。开发者可通过API控制台实时查看各时段的用量明细与费用预估,账单仍沿用官方常规结算周期,保障对账清晰便捷。
价格调整背景与市场反应
这是深度求索首次采用分时计价模式,此前其API长期执行统一一口价策略。2026年以来,伴随Agent类应用的集中爆发,DeepSeek V4系列的全球单日Token消耗量突破8万亿,高峰时段算力负载长期处于高位,而空闲时段算力资源利用率仍有富余。为引导开发者错峰使用、平抑算力拥堵,深度求索在7月中旬发布峰谷定价预告,为开发者留出了一个月的适配过渡期。
目前已有不少企业用户在过渡期内完成了任务调度改造,国内一家电商平台的AI数据团队表示,他们已经将批量商品信息处理、历史用户对话离线分析等非实时任务全部迁移至夜间和周末执行,初步测算月度API综合成本能下降40%左右。
开发者应对策略与行业影响
为帮助开发者快速适配新定价体系,深度求索在官方文档中更新了完整的最佳实践指南,建议开发者优先开启上下文缓存减少重复输入开销,将非紧急的批量数据处理、模型微调、历史数据回填等任务调度至空闲时段执行,仅在高峰时段保留实时对话、在线推理等强时效性业务。同时官方上线了免费的成本预估工具,开发者输入自身的调用量、时段分布参数,即可快速估算调整后的月度费用。
目前已有第三方技术服务商推出了开源的峰谷调度中间件,可自动识别当前时段,将延迟容忍度高的任务自动加入延迟队列,等待空闲时段再执行,进一步降低人工改造成本。这也是国内大模型API领域首次正式落地分时峰谷定价,此前云服务商的算力实例、存储产品已广泛采用类似的分时策略,此次大模型领域的落地,标志着行业正式从过去的无差别低价内卷,转向用价格杠杆优化算力资源配置的精细化运营阶段,后续大概率会有更多大模型厂商跟进推出动态定价方案。
后续观察
截至发稿,深度求索暂未公布峰谷定价实施首日的全平台调用量统计数据,但从过渡期的开发者反馈来看,原本集中在工作日高峰时段的大量非紧急离线任务,已经出现了明显的向空闲时段转移的趋势。深度求索官方表示,将持续跟踪定价实施后的算力负载变化与开发者反馈,在三个月后启动全面评估,根据实际运行情况判断是否优化时段划分或调整峰谷价差比例。开发者也建议,所有使用DeepSeek API的团队都应尽快梳理自身的调用任务类型,区分实时和非实时业务,避免因高峰时段的集中调用产生超出预期的费用。