0一句话速览
预览了 4 个月的旗舰模型 DeepSeek V4 Pro 于 2026-08-13 转正,主打 Agent(智能体)能力全面跃升,同时宣布大幅涨价(峰谷定价,8/17 生效)。这是目前开放权重里 Agent / 编程能力第一梯队的模型,接口兼容 OpenAI / Anthropic,迁移成本极低。
1时间线
- 2026-04-24:V4 Pro 以预览版(Preview)身份首次亮相。
- 2026-08-12 深夜:正式版悄然上线 API(模型版本号
DeepSeek-V4-Pro-0813)。
- 2026-08-13:官方公众号正式官宣,App / 网页端 / API 同步更新。
版本号 DeepSeek-V4-Pro-0813 即 8 月 13 日构建;API 模型名保持不变,无需改代码即可升级。
2核心升级:Agent 能力
正式版最大亮点是智能体能力全面跃升(官方基准,使用 max 思考档):
| 基准测试 | 预览版 | 正式版 | 说明 |
| DeepSWE(AI 编程智能体) | 约 7.3 / 12.8 | 62.7 | 暴涨约 5 倍,超越 Claude Opus 4.8 |
| Cybergym(AI 安全攻防) | — | 83.3 | 超越公认最强的 Claude Fable 5 |
| AutomationBench(自动化任务) | — | 31.8 | 超越 Claude Fable 5 |
英文源(genaidaily,Max 档,厂商自测)补充:SWE-bench Verified 80.6%、GPQA Diamond 90.1%、LiveCodeBench 93.5%;Code Arena WebDev 总榜约第 8(开放权重第 2,仅次于 Kimi K3)。这些是厂商自报分数,非独立评测,理性看待。
3关键规格
- 上下文窗口 100 万 token,单次最高输出 38.4 万 token。
- 接口同时兼容 OpenAI 与 Anthropic 两套格式,原生支持 Responses API 并针对性适配 Codex(一键配置脚本)。
- 思考模式支持 low / high / max 三档强度(V4-Pro 与 V4-Flash 通用):简单任务 low、日常 Agent high、超难任务 max。
- 英文源补充架构:MoE,1.6 万亿总参数 / 490 亿激活,预训练 32 万亿 tokens;新注意力机制(CSA / HCA)把单 token 推理算力压到约 27%、百万上下文下 KV Cache 降到 V3.2 的约 10%。
4价格调整(重点,影响钱包)
官宣采用峰谷定价,新价 2026-08-17 0 时生效。高峰时段为北京时间工作日 9:00–12:00、14:00–18:00,其余为空闲时段(价格为高峰一半)。
| 档位 | 输入(缓存命中) | 输入(缓存未命中) | 输出 |
| 高峰时段 | 0.3 元/百万 | 9 元/百万 | 27 元/百万 |
| 空闲时段 | 0.15 元/百万 | 4.5 元/百万 | 13.5 元/百万 |
对比现行价输出 6 元/百万 → 高峰涨到 27 元(约 +350%),空闲 13.5 元也是现价的 2.25 倍。V4-Flash 同步上调。Pro 并发上限也比 Flash 更低(官方定位"重、贵")。
5对使用者的实用判断
- 值得切过去试:开放权重里 Agent / 编程第一梯队,且接口兼容 OpenAI / Anthropic,迁移几乎零成本——如果你在用中转站或自建 Agent,值得迁移测试。
- 但涨价狠:日常自动化编码用 Flash 更划算,只在难任务上用 Pro。
- 想省钱就错峰:非工作日、或早晚非高峰跑批量任务,价格直接腰斩。
- 先领免费额度:DeepSeek 官方新用户送 500 万 tokens(30 天),可先白嫖体验 V4 Pro(详见另一篇《免费 Token 渠道实战》)。
延伸阅读:本站另两篇原创指南——《Token 是怎么产生的,又是怎么消耗的?》讲清计费本质;《免费 Token 渠道实战》汇总各平台白嫖额度。