深度求索官方宣布,DeepSeek 的 API 价格将采用峰谷定价,闲暇时段价格将等于高峰时段的一半,并于今日正式生效。此举针对企业与开发者在不同工作节奏下的成本压力提供弹性,同时保留原有的 API 模型名与使用模式,方便用户在 APP、网页端或 API 接口选择一致的体验。高峰时段界定为北京时间 9:00 至 12:00、14:00 至 18:00,其余时段则归为闲暇时段。这种定价结构的改动,意味着在工作日中段的请求成本可能出现显著变化,对于需要大量 token 的应用尤为关键。
CNMO 科技在多角度报道中指出,DeepSeek V4 系列在不同时段的成本分布亦有所差异。就 V4-Flash 版本而言,闲暇时段的输入缓存命中成本大约为 0.05 元,输入缓存未命中 1.5 元,输出成本 4.5 元;高峰时段分别为 0.10 元、3.0 元与 9.0 元。V4-Pro 的成本曲线则更为显著,闲暇时段输入缓存命中 0.15 元、未命中 4.5 元、输出 13.5 元,高峰时段分别为 0.30 元、9.0 元与 27.0 元。这些具体数字为开发者在评估成本时提供关键参考,尤其在需要长时间连续推理或高并发的场景中。
值得注意的是,在新定价结构推出前,DeepSeek V4 Pro 的商业版在市场上已同步更新至 APP、网页端与 API。用户可通过 APP 或网页端选择“专家模式”,以使用全新的 V4 Pro 正式版模型;API 模型名称保持不变,确保既有开发者的整合成本最小化。同时,DeepSeek 也强调,现代化的推理过程中,成本计算会以实际调用量与缓存命中率为核心,促使企业在峰值期间维持稳定的用餐式服务水平。如果你正在考虑迁移至 V4 Pro,以取得更高的生成质量,但又担心成本波动,这次峰谷定价或许提供了相对可控的成本预测。
新定价机制下的商业策略与风险
从商业策略角度看,峰谷定价能在工作日的不同时段为用户提供更灵活的成本结构,特别是对于以内容产出、语言模型推理或问答服务为核心的 SaaS 厂商而言,能在非高峰时间降低运营成本,进而通过促销或缓冲时间窗拉动用户需求。对 DeepSeek 而言,这也意味着官方需要更透明的成本与用量报表,让企业客户能够根据实际使用模式优化工作流程,例如将大量的批次作业安排在闲暇时段,以降低整体支出。同时,对于开发者而言,熟悉不同版本在高峰与闲暇时段的成本分布,将有助于设计更有效的缓存与分布式推理策略。
另外,虽然官方尚未公开长期的 SLA 细节,市场观察者普遍关注高峰时段成本的上升幅度可能对即时互动应用造成影响。对于需要低延迟响应与高稳定性的场景,企业可考虑混用不同模型与排程策略,例如在用户请求集中时启用专家模式,于低峰期回落到更具性价比的模型,以维持成本与性能的平衡。根据过去的定价变动经验,透明的版本更新日、API 名称稳定与良好的文档支持,是降低迁移成本与风险的关键。至于模型的稳定性与长期更新,DeepSeek 的官方回应显示,虽然“取外号”等现象引人关注,但其实是推理过程中的上下文占位符,并不会被长期记忆化。此点对于用户信任与隐私保护具有重要启示。
就技术细节而言,市场上最重要的变化在于缓存机制与输出成本的定义。输入缓存命中代表预先缓存的内容能迅速被模型利用,降低整体调用成本;未命中则需重新计算,成本自然提升。输出成本则与文本长度、生成内容的复杂程度相关,对于需要长篇回复或多轮对话的应用影响尤为显著。对 DeepSeek 来说,这些数据点提供了优化闲暇与高峰时段调度的基础,并有助于开发者在设计 API 调用策略时,进行更精准的成本预测。未来若有更多版本的规格公开,开发者可以根据实际性能指标,制定更严谨的成本模型。

