智谱发布 GLM-5.3-Flash:320B 稀疏激活多模态模型,MIT 协议开源
智谱 AI 正式发布 GLM-5.3-Flash(原 OpenRouter 隐身模型 Ox Alpha),采用 320B…
智谱 AI(Zhipu AI)近日正式公布了 GLM-5.3-Flash 模型。该模型此前以「Ox Alpha」的代号出现在 OpenRouter 平台上,作为一款隐身模型被部分用户提前体验;此次发布相当于官方为其揭开了正式面纱。
模型基本规格
根据公开信息,GLM-5.3-Flash 是一款多模态模型,采用混合专家(MoE)架构,具体参数配置为:
- 总参数规模:320B
- 激活参数:18B(每次推理激活约 18B 参数)
- 能力范围:文本 + 图像等多模态输入
- 许可证:MIT License(极为宽松的开源协议)
320B / 18B 的稀疏激活比例属于典型的大体量 MoE 路线,即在保持较高模型容量的同时,显著降低单次推理的计算开销。
开源协议与生态意义
MIT License 是开源协议中限制最少的类型之一,允许用户自由使用、修改、商用和再分发,且不强制衍生作品开源。这意味着开发者可以在几乎零法律门槛的情况下将 GLM-5.3-Flash 集成到自有产品中。考虑到智谱近期在 GLM 系列上的迭代节奏,GLM-5.3-Flash 的开源有望进一步丰富中文及多模态开源模型生态。
「Ox Alpha」前史
在正式发布之前,GLM-5.3-Flash 曾以「Ox Alpha」之名登陆 OpenRouter,以匿名形式供用户测试。该平台历史上出现过多次「先隐身、后官宣」的模型(如部分版本的 Claude、Gemini),GLM-5.3-Flash 同样遵循了这一路径。结合原始报道中「与 Gemini 3.7 Flash 关系密切」的描述,该模型在实际性能与定位上可能瞄准了同档次的轻量级旗舰模型市场。
后续待观察
目前公开信息尚未披露具体的 benchmark 数据、上下文窗口长度、API 定价及上线渠道。后续智谱若同步释放技术报告与评测结果,将更有助于判断 GLM-5.3-Flash 在当前主流大模型竞争格局中的真实位置。
