桃子桃子快讯
返回首页
模型发布

DeepSeek 预告 V4.1-Flash:全新架构家族最小成员,原生支持视觉理解

DeepSeek 在 X 平台发布全新架构系列最小模型 V4.1-Flash,主打原生视觉理解与更高推理吞吐。

2026.09.10 · 周四2 分钟阅读

DeepSeek 于近日在官方 X 账号发布预告,宣布推出全新架构家族中的最小成员 DeepSeek-V4.1-Flash,目前披露的信息仍以方向性描述为主,更多技术细节将在后续推文中逐步放出。

发布概览

根据 DeepSeek 官方在 X 平台发布的首条消息(系列推文第 1 条,共 6 条),V4.1-Flash 被定位为「全新架构家族中最小的模型」,官方在文案中以「更智能、更快速、更高效」作为核心卖点。

  • 名称:DeepSeek-V4.1-Flash
  • 定位:新架构家族最小成员
  • 强调能力:能力更强、推理更快、吞吐更高,可向更大模型方向扩展

核心特性:原生视觉理解

此次预告最值得关注的信息,是 V4.1-Flash 明确具备「原生视觉理解」能力。DeepSeek 在原文中使用「native visual understanding」来描述这一点,意味着模型并非通过外挂视觉编码器的方式实现多模态,而是在架构层面原生支持图像等视觉输入的理解与处理。这与当前主流多模态大模型的设计思路保持一致,也是 DeepSeek 在多模态方向上的重要补齐。

架构与扩展性

DeepSeek 在公告中强调 V4.1-Flash 是新架构家族的起点,并明确提到该架构在设计上:

  • 面向更大模型规模进行扩展(scaling to larger models);
  • 追求更高的推理效率与吞吐表现;
  • 强调在保持能力的同时优化推理成本。

这也意味着,V4.1-Flash 更像是新架构的「能力验证基座」,后续大概率会推出更大参数规模的同架构模型。

当前信息边界

截至本条预告发布,DeepSeek 尚未公开 V4.1-Flash 的以下关键信息:

  • 具体参数量与训练数据规模;
  • 上下文长度与 token 处理能力;
  • 在公开 benchmark 上的成绩与对比;
  • 开源协议、权重发布渠道与上线时间表;
  • API 定价与接入方式。

作为系列推文的第一条,官方给出的更像是产品定位与设计哲学层面的信号,而非可量化的技术指标。后续 5 条推文预计会逐步补充模型能力、benchmark 表现以及开放计划等实质性内容,值得持续关注。

信源