DeepSeek-V4-Pro 模型档案
DeepSeek-V4-Pro 是深度求索 V4 系列的旗舰型号,重点面向复杂推理、知识密集型任务、智能体编程和长链工具调用,同时提供 1M 上下文与开放权重。
- 厂商:杭州深度求索人工智能有限公司(DeepSeek)
- 版本:DeepSeek-V4-Pro(API 模型 ID:deepseek-v4-pro)
- 调用方式:DeepSeek API(OpenAI Chat Completions / Anthropic 兼容格式)或开放权重本地部署
- 上下文窗口:1M tokens
- 计费方式:按输入/输出 Token 计费,缓存命中输入单独计价
本文依据 DeepSeek 官方资料整理,资料与价格核对日期为 2026-07-20。模型价格、限额和接口行为可能调整,生产接入前请再次核对官方模型与价格页。
一句话介绍
DeepSeek-V4-Pro 采用 1.6T 总参数、49B 激活参数的 MoE 架构,是 V4 系列中面向顶级推理、代码和复杂智能体工作流的旗舰开放权重模型。
模型概览
| 项目 | 信息 |
|---|---|
| 模型名称 | DeepSeek-V4-Pro |
| 模型厂商 | DeepSeek(深度求索) |
| 当前版本 | DeepSeek-V4-Pro Preview |
| API 模型 ID | deepseek-v4-pro |
| 发布时间 | 2026-04-24 |
| 模型类型 | 文本生成、复杂推理、代码、智能体、工具调用 |
| 模型架构 | MoE;1.6T 总参数,49B 激活参数 |
| 开源状态 | 开放权重,模型卡标注 MIT License |
| 上下文窗口 | 1M tokens |
| 最大输出长度 | 384K tokens |
| 思考模式 | 支持思考与非思考,默认开启思考 |
| 推理强度 | high / max |
| 原生多模态 | 官方 API 当前未列出图像、音频或视频输入能力 |
| 知识截止时间 | 官方未披露 |
官方发布说明将 Pro 定位为 V4 系列性能最高的型号,强调其知识、数学、STEM、代码和智能体能力。参数规模、上下文长度与开放权重信息来自官方 V4 发布说明及官方 Hugging Face 模型卡。
厂商信息
| 项目 | 信息 |
|---|---|
| 公司/组织 | DeepSeek / 杭州深度求索人工智能有限公司 |
| 所属国家或地区 | 中国 |
| 官方网站 | deepseek.com |
| 开发者平台 | platform.deepseek.com |
| API 文档 | api-docs.deepseek.com |
| 模型主页 | DeepSeek-V4-Pro |
| API 支持邮箱 | api-service@deepseek.com |
厂商简介
DeepSeek 是专注于通用人工智能基础模型研究的中国团队。V4 系列在百万 Token 上下文、推理效率、代码与智能体能力上进行重点优化,并同时发布 Pro 与 Flash 两个开放权重版本。
版本信息
当前推荐版本
模型 ID: deepseek-v4-pro
Pro 适合复杂推理、知识密集型问答、长链智能体、软件工程和高难度代码任务。官方 API 中思考模式默认开启;常规请求的默认推理强度为 high,复杂编码智能体可使用 max。
V4 系列版本
| 版本/模型 ID | 发布日期 | 定位 | 状态 |
|---|---|---|---|
deepseek-v4-pro |
2026-04-24 | 旗舰推理、知识、代码和复杂智能体 | Preview / 可用 |
deepseek-v4-flash |
2026-04-24 | 高吞吐、低成本、常规推理和简单智能体 | Preview / 可用 |
deepseek-chat |
历史兼容名 | 临时映射到 V4-Flash 非思考模式 | 2026-07-24 停用 |
deepseek-reasoner |
历史兼容名 | 临时映射到 V4-Flash 思考模式 | 2026-07-24 停用 |
版本信息以DeepSeek 更新日志为准。
版本选择建议
- 复杂推理与研究:优先 Pro。
- 复杂智能体与 Agentic Coding:优先 Pro,并评估
reasoning_effort=max。 - 知识密集型任务:优先 Pro。
- 高吞吐在线业务:优先 Flash,必要时仅对困难请求路由到 Pro。
- 成本敏感任务:先用 Flash 建立基线,再评估 Pro 的质量收益是否值得额外成本。
核心能力
| 能力 | 支持情况 | 说明 |
|---|---|---|
| 文本生成 | 支持 | 官方 API 当前主要提供文本能力 |
| 复杂推理 | 强项 | 支持思考模式和 high / max 推理强度 |
| 代码生成 | 强项 | 官方重点强调智能体编码能力 |
| 知识问答 | 强项 | 官方定位为 V4 系列知识能力更强的型号 |
| JSON Output | 支持 | 可用于结构化数据输出 |
| Tool Calls | 支持 | 思考与非思考模式均可使用 |
| 对话前缀续写 | Beta | 需使用对应 Beta 能力 |
| FIM 补全 | Beta | 仅非思考模式支持 |
| 流式输出 | 支持 | 使用 stream=true |
| 上下文缓存 | 支持 | API 默认启用磁盘上下文缓存 |
| 图像/音频/视频 | 未列出 | 不应假设具备原生多模态输入能力 |
调用信息
可用渠道
| 渠道 | 可用性 | 入口 | 备注 |
|---|---|---|---|
| DeepSeek 官方 API | 可用 | 开放平台 | 推荐的托管调用方式 |
| OpenAI 兼容格式 | 可用 | https://api.deepseek.com |
使用 Chat Completions 接口 |
| Anthropic 兼容格式 | 可用 | https://api.deepseek.com/anthropic |
可接入 Claude Code 等生态 |
| DeepSeek 网页端 | 可用 | chat.deepseek.com | 官方发布说明称对应 Expert Mode |
| 开放权重本地部署 | 可用 | Hugging Face 模型页 | 1.6T 总参数,对硬件要求极高 |
接口信息
| 项目 | 信息 |
|---|---|
| OpenAI 格式 Base URL | https://api.deepseek.com |
| Anthropic 格式 Base URL | https://api.deepseek.com/anthropic |
| Chat Completions | POST /chat/completions |
| 鉴权方式 | Bearer API Key |
| 模型 ID | deepseek-v4-pro |
| 流式输出 | 支持 |
| 默认思考模式 | 开启 |
| 官方 SDK | 可使用 OpenAI SDK 或 Anthropic SDK |
环境变量
DEEPSEEK_API_KEY="your-api-key"
DEEPSEEK_BASE_URL="https://api.deepseek.com"
DEEPSEEK_MODEL="deepseek-v4-pro"
cURL 调用示例
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DEEPSEEK_API_KEY" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{"role": "system", "content": "你是一名资深软件架构师。"},
{"role": "user", "content": "请评审这个支付系统的幂等与补偿设计。"}
],
"thinking": {"type": "enabled"},
"reasoning_effort": "max",
"stream": false
}'
Python 调用示例
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DEEPSEEK_API_KEY"],
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[
{"role": "system", "content": "你是一名资深软件架构师。"},
{"role": "user", "content": "请分析订单系统的并发一致性风险。"},
],
reasoning_effort="max",
extra_body={"thinking": {"type": "enabled"}},
)
print(response.choices[0].message.content)
Anthropic SDK 调用示例
import os
import anthropic
client = anthropic.Anthropic(
api_key=os.environ["DEEPSEEK_API_KEY"],
base_url="https://api.deepseek.com/anthropic",
)
message = client.messages.create(
model="deepseek-v4-pro",
max_tokens=4096,
system="你是一名资深软件架构师。",
messages=[{"role": "user", "content": "设计一个可恢复的任务调度系统。"}],
output_config={"effort": "max"},
)
print(message.content)
思考模式注意事项
- OpenAI 格式使用
thinking.type=enabled/disabled控制思考模式。 - OpenAI 格式使用
reasoning_effort=high/max控制推理强度。 - Anthropic 格式使用
output_config.effort=high/max。 - 思考模式下
temperature、top_p、presence_penalty、frequency_penalty不生效。 - 思考模式配合工具调用时,后续请求必须完整回传当前轮的
reasoning_content。
详细行为参见官方思考模式文档和Anthropic API 兼容说明。
价格与配额
价格核对日期:2026-07-20
| 计费项目 | 单价 | 计费单位 |
|---|---|---|
| 输入 Token(缓存命中) | 0.025 元 | 每百万 Token |
| 输入 Token(缓存未命中) | 3 元 | 每百万 Token |
| 输出 Token | 6 元 | 每百万 Token |
限流与配额
- 账户并发限制:500。
- 超出并发限制:返回 HTTP 429。
- 提高并发:可向 DeepSeek 提交扩容申请。
user_id:可用于内容安全、KV Cache 和调度隔离;不要放入隐私信息。
模型优势
- V4 系列旗舰型号,官方重点强调复杂推理、知识、数学、STEM 和代码能力。
- 面向复杂智能体工作流与 Agentic Coding 进行专项优化。
- 支持 1M 上下文和最高 384K 输出,适合大型代码库与长文档任务。
- 支持思考/非思考双模式、工具调用、JSON Output 和上下文缓存。
- 提供开放权重和 MIT License 模型卡,便于研究与私有化评估。
已知限制
- API 调用价格约为 Flash 的三倍,需要通过任务路由控制成本。
- 默认并发 500,低于 Flash 的 2500,不适合不加分流的超高并发简单任务。
- 官方 API 当前以文本任务为主,未列出原生图像、音频或视频输入能力。
- 思考模式可能带来更长响应时间与更多输出 Token。
- 1.6T 总参数的本地部署硬件门槛极高,绝大多数团队更适合使用托管 API。
- 模型输出仍可能出现事实错误,高风险场景必须人工复核。
推荐使用场景
- 复杂数学、科学、工程和逻辑推理。
- 大型代码库分析、架构设计与 Agentic Coding。
- 多步骤工具调用和长链智能体任务。
- 知识密集型研究、长文档综合与证据整理。
- 对结果质量要求高、可接受更高成本与延迟的核心任务。
- 作为模型路由系统中的高能力升级通道。
不推荐使用场景
- 简单分类、改写、摘要等可由 Flash 完成的高频任务。
- 对低延迟和高并发极度敏感的在线链路。
- 依赖原生视觉、语音或视频理解的任务。
- 无人工复核的医疗、法律、金融决策。
- 缺少大规模 GPU 集群却计划全量本地部署的项目。
与 DeepSeek-V4-Flash 对比
| 项目 | DeepSeek-V4-Pro | DeepSeek-V4-Flash |
|---|---|---|
| 总参数 / 激活参数 | 1.6T / 49B | 284B / 13B |
| 上下文窗口 | 1M | 1M |
| 最大输出 | 384K | 384K |
| 输入价(未命中缓存) | 3 元/百万 Token | 1 元/百万 Token |
| 输出价 | 6 元/百万 Token | 2 元/百万 Token |
| 默认并发 | 500 | 2500 |
| 核心定位 | 最强推理、知识和复杂智能体 | 快速、经济、高吞吐 |
推荐路由策略
- 默认请求先进入 Flash。
- 遇到复杂推理、长链工具调用或质量不足时升级到 Pro。
- 批处理、分类、摘要和简单代码任务保持使用 Flash。
- 为 Pro 设置独立预算、超时和并发保护。
- 记录 Flash 与 Pro 的质量、时延和成本数据,持续调整路由规则。
安全、隐私与合规
| 项目 | 说明 |
|---|---|
| API 密钥 | 只通过服务端环境变量管理,不写入前端或仓库 |
| 用户隔离 | 可通过 user_id 隔离 KV Cache、调度和内容安全上下文 |
| 数据处理 | 应按 DeepSeek 开放平台条款和适用隐私政策单独评估 |
| 数据保留 | 公开 API 文档未给出统一的零保留承诺,企业接入前应向官方确认 |
| 高风险输出 | 仅作参考,重要结论需由专业人员复核 |
DeepSeek 的一般隐私政策说明,相关服务的数据可能在中国境内服务器处理和存储;但开发者下游系统中最终用户数据的处理规则需要结合开放平台条款单独确认。参见DeepSeek 隐私政策和开放平台服务条款。
迁移与兼容性
- V4-Pro 是新的独立模型 ID,不要继续使用
deepseek-reasoner代表旗舰推理模型。 - 使用 OpenAI SDK 时,
thinking通过extra_body传递。 - 使用 Anthropic SDK 时,将 Base URL 指向
https://api.deepseek.com/anthropic。 - 从 Flash 升级到 Pro 通常只需替换模型 ID,但仍应回归测试输出质量、时延和成本。
- 上线前验证工具调用的
reasoning_content回传、超时、429 重试和预算保护。
结论
DeepSeek-V4-Pro 是 V4 系列面向复杂任务的旗舰选择。它与 Flash 共享 1M 上下文和完整 API 能力,但以更大的参数规模换取更强的知识、推理、代码和智能体表现。对于架构分析、高难度代码、科研推理和长链工具调用,Pro 值得优先评估;对于简单高频任务,则更适合采用“Flash 默认、Pro 升级”的模型路由策略,以平衡质量、时延和成本。
官方资料
- DeepSeek-V4 发布说明
- 模型与价格
- 快速开始与 API 示例
- 思考模式
- Anthropic API 兼容说明
- 限速与隔离
- DeepSeek-V4-Pro 官方模型卡
- DeepSeek-V4 官方模型集合
- DeepSeek 隐私政策
更新记录
| 日期 | 更新内容 | 编辑者 |
|---|---|---|
| 2026-07-20 | 根据 DeepSeek 官方文档创建模型档案 | 一六聊技术 |