DeepSeek 更新 V4-Pro 模型,具备 1M 上下文和 384K 输出能力

DeepSeek 旗下的 deepseek-v4-pro 模型版本已更新为 DeepSeek-V4-Pro-0813。根据目前公布的信息,此次更新并未伴随价格调整。尽管 DeepSeek 之前曾发布公告表示计划近期整体上调 API 服务定价,但当前各档位价格仍与此前保持一致。

DeepSeek-V4-Pro-0813 更新带来的核心规格提升

在核心规格方面,deepseek-v4-pro 支持 1M 上下文长度,最大输出长度达到 384K Token,同时支持非思考模式和思考模式,其中思考模式预设为开启。对于长代码库处理、大规模文档分析以及需要连续执行大量步骤的 Agent 任务来说,1M 上下文窗口和 384K 最大输出意味着单次调用能够容纳和生成的内容规模相当可观,减少了多轮拆分和拼接的开销。

在配套能力方面,deepseek-v4-pro 基本覆盖了目前主流的 Agent 开发需求。该模型支持 JSON Output、Tool Calls、Responses API 和 Anthropic API,同时支持处于 Beta 阶段的对话前缀续写与 FIM 补全功能,其中 FIM 补全仅限在非思考模式下使用。

在 API 接入方式上,deepseek-v4-pro 同时兼容 OpenAI 和 Anthropic 两套格式,开发者可以根据自身技术栈灵活选择接入路径。价格方面,deepseek-v4-pro 当前每百万 Token 的计费标准分别为:缓存命中输入为 0.025 元,缓存未命中输入为 3 元,输出为 6 元。

DeepSeek 的 Pro 版本在价格和性能上的比较

作为对比,同系列的 deepseek-v4-flash 每百万 Token 价格分别为缓存命中输入 0.02 元、缓存未命中输入 1 元、输出 2 元。也就是说,在缓存未命中输入和输出这两个主要计费项目上,Pro 版本的价格均为 Flash 版本的 3 倍。虽然 Pro 的绝对价格高于 Flash,但考虑到其更大的上下文窗口和输出能力,单位 Token 的性价比依然具备竞争力。

两个版本在并发限制上也有所区分。deepseek-v4-flash 的并发限制为 2500,deepseek-v4-pro 则为 500。从这一配置差异来看,Flash 更明显地面向高频、大规模的调用场景,适合需要快速响应和大量并行请求的应用;而 Pro 则将资源进一步集中到规格更高的任务上,优先保障单次调用的深度和复杂度。

stone
stone