桃子桃子快讯
返回首页
模型发布

DeepSeek 发布 V4-Pro:Agent 能力升级,支持可调推理档位

DeepSeek 今日上线 V4-Pro,主打 Agent 生产可用性升级,并引入低/高/最大三档可调推理强度。

2026.08.13 · 周四2 分钟阅读

DeepSeek 今日通过官方 X 账号宣布上线 V4-Pro 模型,主打 Agent 场景下的生产可用性升级,并首次引入可灵活调节的推理档位机制。V4-Flash 也同步获得相关能力更新。

本次更新要点

  • Agent 能力强化:官方称 V4-Pro 在生产环境中的 Agent 工作流上取得显著提升。
  • 三档推理强度:V4-Pro 与 V4-Flash 均支持低(简单任务)、高(日常 Agent)、最大(复杂任务)三档可调推理力度,用户可按场景灵活取舍。
  • 兼容 OpenAI Responses API:新增对 OpenAI Responses API 的原生支持,并针对 Codex 做了一键配置优化,便于既有 OpenAI 工具链用户迁移。
  • 渠道同步上线:V4-Pro 已在 App 与网页端开放,可通过「Expert Mode」试用;同时提供 API 调用,模型名称保持不变,开发者可直接查阅官方 API 文档完成接入。

关于推理档位

可调推理档位是近期主流模型常见的设计思路:在简单问答、常规 Agent 任务与高难度推理之间提供显式档位,使用户在响应延迟与推理深度之间做权衡。DeepSeek 此次将该机制下沉到 V4-Fash 这一轻量档位,意味着低延迟场景也能按需启用更强的推理能力。

兼容性与迁移成本

原生支持 OpenAI Responses API 并提供 Codex 一键配置,是本次发布对开发者最实际的改动。对已在使用 OpenAI 兼容接口的团队而言,模型名称不变、文档可查,迁移成本相对可控;对 Codex 用户而言,则省去了额外的接口适配工作。

待观察事项

截至发稿,官方公告以要点形式呈现,未披露具体 benchmark 数据、上下文窗口、参数规模或定价变化。V4-Pro 与 V4-Flash 在三档推理下的实际效果差异、延迟与成本对比,以及与上一代 V3 系列的全面能力对比,仍需等待官方进一步公布或社区实测补全。

信源