DEEPSEEK · 2026-04-24 开源发布 · 2026-08-13 V4-Pro GA

DeepSeek V4

百万上下文,万亿参数,全部开源。

V4-Pro 与 V4-Flash 两个版本同日发布:1.6T 总参数的旗舰模型, 性能对标顶级闭源模型;284B 的轻量版本兼顾速度与成本。 1M 上下文不再是一个卖点——它是所有官方服务的默认值。

  • MIT License
  • 1M ctx · 默认
  • Thinking / Non-Thinking

0T

V4-Pro 总参数量(MoE)

0B

每 token 激活参数

0M

官方服务默认上下文长度

MIT

开源许可,权重开放

两个版本

一个标准,两种取舍

旗舰与轻量共享同一套能力基线:1M 上下文、双模式思考、OpenAI 与 Anthropic 兼容的 API。 差别只在规模、速度与成本。

deepseek-v4-pro

旗舰 · 对标闭源顶流

PRO
1.6T总参数
49B激活参数
  • Agentic Coding 基准:开源 SOTA
  • Math / STEM / Coding:领先全部开源模型
  • 世界知识:仅次 Gemini-3.1-Pro
  • 推理能力对标顶级闭源模型

deepseek-v4-flash

轻量 · 快与省的默认选择

FLASH
284B总参数
13B激活参数
  • 推理能力接近 V4-Pro
  • 简单 Agent 任务与 V4-Pro 持平
  • 响应更快,API 定价更低
  • deepseek-chat 的默认落点

两个版本共享

  • 1M 上下文(默认,非上限)
  • Thinking / Non-Thinking 双模式
  • OpenAI ChatCompletions 与 Anthropic API 兼容
  • Hugging Face 开放权重,MIT 许可

技术要点

四件事,改变使用方式

01

Token 压缩 + 稀疏注意力

DSA(DeepSeek Sparse Attention)先把历史 token 逐段压缩,再按需稀疏检索, 长上下文的计算与显存开销被大幅削平。1M 上下文因此不再是旗舰专属—— 而是所有版本的默认配置。

02

为 Agent 工作流而生

Agentic Coding 基准拿到开源 SOTA,DeepSeek 内部已经把 V4 接进自己的编码 Agent。 主流 Agent 工具换一行配置即可接入:Claude Code、OpenClaw、OpenCode 都已支持指向 V4 的 API。

03

思考,或者不思考

同一套权重内置两种模式:需要逐步推理时打开 Thinking,追求低延迟时切到 Non-Thinking。API 里一个字段即可切换,深度与速度不再二选一。

04

1M 上下文成为默认

不是“支持 1M”,而是默认 1M。整个代码仓库、整本书、整份技术文档, 一次全部放进去。对照常见闭源方案的 200K,V4 把上下文天花板抬高了五倍。

能力对照

按维度,按版本

以下结论来自 DeepSeek V4 技术报告与官方公告;完整评测方法见 技术报告 PDF

维度V4-ProV4-Flash相对闭源顶流
Agentic Coding开源 SOTA接近 Pro对标顶级闭源
Math / STEM / Coding开源第一接近 Pro对标顶级闭源
世界知识开源第一仅次 Gemini-3.1-Pro
长上下文1M 默认1M 默认全球领先

数据截至 2026-08-13(V4-Pro GA)。

发布历程

从 V3 到 V4,一年半

  1. DeepSeek-V3 发布,671B MoE 开源。

  2. V3.1 统一 Chat / Reasoner,开放思维链。

  3. V3.2-Exp 引入稀疏注意力探索。

  4. V3.2 正式发布,上下文与工具调用升级。

  5. V4 Preview 开源 — Pro 与 Flash 双版本,1M 上下文普惠。里程碑:当天开放权重与 API。

  6. V4-Pro GA — 正式商用版本上线,deepseek-chat / deepseek-reasoner 完成迁移。

现在就用 V4

权重开放,API 即日可用,在线体验已上线。