DeepSeek V4 Pro 正式版上线:Agent 能力大幅跃升,价格仍处地板位
DeepSeek V4 Pro(0813)正式版上线,Agent 类基准暴涨,提供 1M 上下文与 384K 输出,价格…
DeepSeek 官方文档近日更新了模型日期为 Deepseek-V4-Pro-0813,意味着 V4 Pro 正式版已对外提供,官方 API 中可直接调用。作为 V4 Flash 之后的高端型号,V4 Pro 在 Agent、长上下文和性价比三方面都做了显著强化。
架构与上下文规格
V4 Pro 延续 MoE 设计,总参数规模 1.6 万亿,每次推理激活约 490 亿参数。接口侧提供 100 万 Token 上下文窗口与最高 38.4 万 Token 输出,并支持思考开关、工具调用、结构化 JSON、Responses API,以及 OpenAI 和 Anthropic 两种兼容格式。
这意味着模型不仅在「思考深度」上继续强化,也从装入大型代码库、理解海量资料到连续调用工具完成长流程任务多个维度提升 Agent 能力。
基准表现:预览版到正式版近乎「脱胎换骨」
正式版相对预览版在 Agent 类评测上几乎是全面跃升:
- Terminal Bench 2.1:72.1 → 87.9,提升 15.8 分
- DeepSWE:12.8 → 62.7,约为预览版的 4.9 倍
- AutomationBench:12.8 → 31.8
- DSBench-FullStack:41.8 → 71.1
- DSBench-Hard:31.1 → 67.2
- CyberGym(安全攻防):52.7 → 83.3
横向对比中,Terminal Bench 2.1 上 87.9 的成绩仅落后 Kimi K3 的 88.3 约 0.4 分;HLE 开启工具后得分 60.0,仅次于 Fable 5 的 63.0;CyberGym 上 83.3 略高于 Opus 4.8 的 78.3。整体来看,V4 Pro 正式版在终端操作、代码工程、工具调用、安全攻防和长任务执行等维度基本未掉出第一梯队。
价格与 API 兼容性
截至发文,DeepSeek 官方给出的 Pro 版百万 Token 价格为:缓存命中输入 0.025 元、缓存未命中输入 3 元、输出 6 元。相比 Flash 版的 1 元输入、2 元输出更高,但放到旗舰 Agent 模型中仍处低位。作为参考,Kimi K3 当前 API 价格为缓存未命中输入 3 美元、输出 15 美元;Fable 5 更是输入 10 美元、输出 50 美元。即便考虑币种差异,DeepSeek 的价格也只是海外同级模型的零头。
API 兼容性方面,V4 Pro 同时支持 OpenAI 格式、Anthropic 格式、Responses API、Tool Calls 与 JSON Output,官方已给出 Claude Code、OpenCode、OpenClaw 等 Agent 工具的接入方案,迁移成本相对较低。
限制与价格预警
需要注意的是两点:
- 并发上限:V4 Pro 账号并发上限为 500,而 Flash 版为 2500。能力更强、单次任务更长,意味着它更适合复杂任务与高价值工作流,而非承接所有高频小请求。
- 价格上调预警:DeepSeek 已在价格页注明,近期计划整体上调 API 价格,且预计涨幅较大。当前的低价位更像是窗口期,不能视为永久承诺。
综合来看,V4 Pro 正式版凭借暴涨的 Agent 分数、1M 上下文和仍处低位的价格,把旗舰 Agent 模型的门槛又往下拉了一截。模型调用名未变,但通过旧 API 拿到的能力已经与此前不在同一量级。
