DeepSeek V4.1 Flash 上线 Together AI,主打低成本长上下文
DeepSeek V4.1 Flash 在 Together AI 平台开放使用,号称在智能体基准上以三分之一成本超越某…
AI 云服务平台 Together AI 在其官方 X 账号宣布,DeepSeek 最新模型 DeepSeek V4.1 Flash 已正式在该平台上线,面向开发者与 enterprises 提供推理服务。该消息以单条推文形式发布,包含若干关键规格与性能对比声明,但具体的技术报告与完整基准数据尚未在推文中披露。
核心规格
根据 Together AI 公布的信息,DeepSeek V4.1 Flash 的关键参数如下:
- 总参数量:552B
- 上下文窗口:1M tokens
- 原生支持:多模态输入
- 模型定位:Flash 版本,主打高效推理
这一参数规模介于 DeepSeek 此前 V3 系列的 671B 与轻量蒸馏版本之间,1M tokens 的上下文长度与原生多模态输入是面向长文档理解、复杂智能体任务的关键能力。
性能与成本声明
Together AI 在公告中给出了两项引人注目的对比声明:
- 在智能体(agentic)类基准测试上,DeepSeek V4.1 Flash 表现优于「GPT-5.6 sol」。
- 单任务推理成本约为上述对比对象的三分之一。
需要指出的是,公告并未随附具体的基准名称、分数或评测方法,「GPT-5.6 sol」这一具体型号名称在公开资料中尚不常见,相关对比的复现条件与适用范围有待官方进一步披露。成本声明亦为相对值,未提供每千 token 美元单价等绝对数字。
上线背景与开发者意义
Together AI 是国际市场上主流的开源权重模型托管与推理平台之一,长期提供 Llama、Mistral、DeepSeek 等系列模型的 API 服务。DeepSeek V4.1 Flash 的上线意味着开发者无需自行部署 552B 参数级别的大模型,可通过 Together AI 的基础设施直接调用,对于希望在长上下文与智能体场景中控制成本的应用方而言是一个新的选项。
待确认事项
由于公告来源为单条推文,以下信息仍需等待 DeepSeek 或 Together AI 的进一步发布:
- 完整的基准测试成绩与对比方法
- MoE 架构下的激活参数与推理吞吐量
- 定价细节与速率限制
- 是否同步开放模型权重下载
在缺乏详细技术报告的情况下,开发者可在 Together AI 平台试用以实测其实际表现。
