DeepSeek V4 Flash 上线原生视觉,Fireworks 平台首发
Fireworks AI 宣布 DeepSeek V4 Flash 接入原生视觉能力,定价与旧版持平,基准表现优于纯文本…
Fireworks AI 在其官方 X 账号上宣布,DeepSeek V4 Flash 现已支持原生视觉(native vision)能力,在该平台的 serverless 与 priority 档位同步上线。官方同时披露了定价信息:在新增视觉能力后,输入价格为每百万 token 0.22 美元,输出价格为每百万 token 0.66 美元,与此前的纯文本版本保持一致。
原生视觉能力上线
此次更新使 DeepSeek V4 Flash 从纯文本模型升级为支持图像输入的多模态模型。Fireworks AI 用「Give your workhorse model eyes」作为宣传语,意在让这款以性价比见长的模型具备理解图像的能力,覆盖图文理解、视觉问答等典型场景。开发者在调用时可直接传入图像数据,无需额外接入独立的视觉模型。
价格与基准表现
Fireworks AI 在公告中表示,新的视觉版本基准表现优于此前仅支持文本的 0731 版本,且价格维持不变:
- 输入:0.22 美元 / 百万 token
- 输出:0.66 美元 / 百万 token
- 部署档位:serverless 与 priority 均已可用
不过官方在公告中未公布具体的基准测试项目名称、得分或对比数据,仅以「better benchmarks than the text-only 0731 version」一笔带过,具体的视觉理解能力细节仍需第三方评测进一步验证。
对开发者的意义
对于已在 Fireworks AI 平台上调用 DeepSeek 系列模型的开发者而言,这一更新降低了接入多模态能力的门槛:无需切换到更大或更贵的模型,即可在原有 API 接口中直接处理图像输入。结合此前已有的低定价策略,DeepSeek V4 Flash 在视觉场景下的成本优势依然明显,适合大批量、对价格敏感的图文应用。开发者可在 Fireworks AI 官网直接试用,平台也提供了对应的接入文档以协助迁移。
