deepseek-v4-pro
旗舰 · 对标闭源顶流
- Agentic Coding 基准:开源 SOTA
- Math / STEM / Coding:领先全部开源模型
- 世界知识:仅次 Gemini-3.1-Pro
- 推理能力对标顶级闭源模型
0T
V4-Pro 总参数量(MoE)
0B
每 token 激活参数
0M
官方服务默认上下文长度
MIT
开源许可,权重开放
两个版本
旗舰与轻量共享同一套能力基线:1M 上下文、双模式思考、OpenAI 与 Anthropic 兼容的 API。 差别只在规模、速度与成本。
旗舰 · 对标闭源顶流
轻量 · 快与省的默认选择
技术要点
01
DSA(DeepSeek Sparse Attention)先把历史 token 逐段压缩,再按需稀疏检索, 长上下文的计算与显存开销被大幅削平。1M 上下文因此不再是旗舰专属—— 而是所有版本的默认配置。
02
Agentic Coding 基准拿到开源 SOTA,DeepSeek 内部已经把 V4 接进自己的编码 Agent。 主流 Agent 工具换一行配置即可接入:Claude Code、OpenClaw、OpenCode 都已支持指向 V4 的 API。
03
同一套权重内置两种模式:需要逐步推理时打开 Thinking,追求低延迟时切到 Non-Thinking。API 里一个字段即可切换,深度与速度不再二选一。
04
不是“支持 1M”,而是默认 1M。整个代码仓库、整本书、整份技术文档, 一次全部放进去。对照常见闭源方案的 200K,V4 把上下文天花板抬高了五倍。
数据截至 2026-08-13(V4-Pro GA)。
发布历程
DeepSeek-V3 发布,671B MoE 开源。
V3.1 统一 Chat / Reasoner,开放思维链。
V3.2-Exp 引入稀疏注意力探索。
V3.2 正式发布,上下文与工具调用升级。
V4 Preview 开源 — Pro 与 Flash 双版本,1M 上下文普惠。里程碑:当天开放权重与 API。
V4-Pro GA — 正式商用版本上线,deepseek-chat / deepseek-reasoner 完成迁移。
权重开放,API 即日可用,在线体验已上线。