DeepSeek V4 Pro 正式版上线:1M 上下文、384K 输出,价格与并发配置同步公开

2026/08/13 09:04阅读量 5

DeepSeek 发布 V4 Pro 正式版,模型版本更新为 DeepSeek-V4-Pro-0813,支持 1M 上下文和 384K 最大输出,并兼容 OpenAI 与 Anthropic API。价格方面,Pro 版缓存未命中输入 3 元/百万 Token、输出 6 元/百万 Token,均为 Flash 版的 3 倍,但并发限制低于 Flash。

事件概述

DeepSeek 正式上线 V4 Pro 模型,对应版本号为 DeepSeek-V4-Pro-0813,并更新了模型与价格页面。该模型定位高于 V4 Flash,面向更高规格的任务场景。

核心能力

  • 支持 1M 上下文长度,最大输出 384K Token
  • 提供非思考模式思考模式,其中思考模式默认开启。
  • 支持 JSON Output、Tool Calls、Responses API、Anthropic API
  • 处于 Beta 阶段的对话前缀续写FIM 补全(FIM 仅限非思考模式)。
  • API 接入同时兼容 OpenAIAnthropic 两套格式。

这使 V4 Pro 能够应对长代码库、大规模文档处理,以及需要连续执行大量步骤的 Agent 任务。

价格与配额

deepseek-v4-pro 当前每百万 Token 价格:

  • 缓存命中输入:0.025 元
  • 缓存未命中输入:3 元
  • 输出:6 元

对比 deepseek-v4-flash 的 0.02 元、1 元、2 元,Pro 在缓存未命中输入和输出两项上均为 Flash 的 3 倍。并发限制方面,Flash 为 2500,Pro 为 500

产品定位

Flash 主打更低成本和更高并发,适合高频、大规模调用;Pro 则把资源集中在规格更高的任务上,并围绕 Tool Calls、Responses API、Anthropic API 能力向 Agent 和 Coding 场景延伸。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。