桃子桃子快讯
返回首页
模型发布

ZenMux 推出 V4-Flash 模型:284B 总参数 / 13B 激活,支持 1M 上下文

AI 资讯聚合平台 ZenMux 上线 V4-Flash,采用 MoE 架构(284B 总参数 / 13B 激活),支持…

2026.08.01 · 周六2 分钟阅读

AI 资讯账号 TestingCatalog 在 X 平台披露,模型聚合平台 ZenMux 已上线一款名为 V4-Flash 的新模型。该模型采用混合专家(MoE)架构,总参数量达 284B,每次推理激活约 13B 参数,上下文窗口为 1M token,规格上属于当前偏长上下文路线的轻量级 MoE 方案。

模型规格

根据 TestingCatalog 的帖子,V4-Flash 的关键参数如下:

  • 总参数:284B
  • 激活参数:约 13B
  • 上下文窗口:1M token
  • 架构:MoE

帖子同时指出,V4-Flash 相比前代的主要增益「来自后训练阶段」(post-training),暗示其在预训练架构层面变化有限,更多依赖后训练(如指令微调、对齐、蒸馏等)来提升效果。

平台与协议兼容

V4-Flash 并非独立 API 服务,而是挂在 ZenMux 平台下,与该平台上的其他前沿模型一同提供。ZenMux 同时提供对 OpenAI 与 Anthropic 协议的兼容支持,意味着开发者可以直接使用 Claude Code 等已适配 Anthropic 协议的客户端工具来调用 ZenMux 上的模型,对已有 Claude Code 工作流的用户而言切换成本较低。

信息局限

目前公开信息仅来自 TestingCatalog 的一条 X 贴文,未见 V4-Flash 的官方模型卡、研发机构、技术博客或基准测试数据。开发者关心的推理速度、显存占用、中文能力、多模态支持、价格等指标均未披露,模型的归属方与训练细节也尚不清晰。在缺乏一手官方资料的情况下,V4-Flash 的实际表现与定位仍有待进一步验证。

注:本文信息均整理自 TestingCatalog 的 X 平台帖子,尚未经官方渠道确认。

信源