模型发布
DeepSeek-V4-Flash 上线 Fireworks 与 ZenMux,主打低成本长上下文
DeepSeek 推出 V4 系列效率版 V4-Flash-0731,已在 Fireworks、ZenMux 上线,号称…
2026.08.01 · 周六约 2 分钟阅读
DeepSeek 近日推出 V4 系列的效率导向版本 DeepSeek-V4-Flash(版本号 0731),已在 Fireworks AI、ZenMux 等平台上线 API。据 DeepSeek 官方披露,V4-Flash-0731 作为预览版与旗舰 V4-Pro 一同开源,主打在保持 V4 系列长上下文与推理能力的前提下,提供更经济、响应更快的 API 档位。
多平台同步上线
- Fireworks AI 已于发布首日(day-zero)接入 V4-Flash-0731,成为首批支持该模型的推理平台之一。
- ZenMux 同步上线该模型,并自称是唯一提供官方 0731 版本的 DeepSeek 服务商,同时开放限时免费试用。
- 该版本已支持 OpenAI Responses API 格式,方便现有应用平滑迁移。
性能与定价
根据官方公布的数据,V4-Flash-0731 在全部 9 项 agentic 评测中超越 V4-Pro,其中 Terminal Bench 得分达到 82.7%。在定价方面,V4-Flash 提供 1M token 长上下文窗口,输入价格为 0.28 美元 / 百万 token,官方称其单任务成本优于 V4-Pro。该定位与官方描述的「为需要 V4 代长上下文与推理能力、但希望获得更快、更经济 API 档位的开发者」相吻合。
后续旗舰待发
DeepSeek 在社区消息中透露,V4-Pro 正式版预计将「尽快」发布(ASAP),这意味着 V4-Flash-0731 只是 V4 系列分阶段推出的前奏。对于关注国产开源大模型生态的开发者和企业用户而言,V4-Pro 正式版的实际表现与开放权重细节,将是下一阶段的关注重点。
对开发者的意义
- 长上下文 + 低单价:1M 上下文窗口配合 0.28 美元 / 百万 token 的定价,适合需要处理大文档或多轮 agent 任务的高并发场景。
- 生态兼容:支持 Responses API,降低从 OpenAI 体系迁移或并行使用的接入成本。
- 阶段性版本:0731 为预览版本号,正式版能力与稳定性仍需在实际业务负载中验证,建议先做小流量灰度测试。
