模型发布
智谱发布 GLM-5.3-Flash:320B 参数 MoE 模型、MIT 开源、运行于国产 AI 芯片
智谱推出 GLM-5.3-Flash,320B 总参 / 18B 激活的 MoE 模型,支持 1M token 上下文与…
2026.08.26 · 周三约 2 分钟阅读
智谱(Z.ai)正式发布 GLM-5.3-Flash 模型,主打「领先能力 + 极具竞争力的定价」路线,原生多模态、支持百万级上下文,并以 MIT 协议开源权重。该模型此前以代号 Ox Alpha 进行预览,如今正式面向所有官方渠道开放。
模型规格与架构
GLM-5.3-Flash 采用 MoE(混合专家)架构,总参数量为 320B,每次推理激活 18B 参数,在保证能力上限的同时控制推理成本。模型原生支持多模态输入,并具备 1M token 的上下文窗口,适合长文档理解、代码库分析与复杂多轮对话等场景。官方强调,模型在整个生命周期中完全运行于国产 AI 芯片,基础设施层面实现了自主可控。
开源与许可
本次发布最值得关注的亮点之一是授权方式:模型权重以 MIT License 开源,允许商业使用、修改与再分发,对开发者和企业十分友好。模型已在以下渠道同步上线:
- 权重下载:官方仓库(Hugging Face 等平台)
- API 接入:智谱官方 API 平台
- 编程订阅:GLM Coding Plan
- 开发者工具:ZCode
- 聊天体验:Z.ai Chat
- 自动化平台:AutoClaw
行业意义
GLM-5.3-Flash 此前以 Ox Alpha 之名进行预览,本次正式发布意味着从「实验室预览」走向「可生产部署」。结合 MIT 协议、国产芯片适配和百万 token 上下文三项特性,智谱在中文大模型生态中同时推进了开放性与基础设施自主化两条主线,对国内开源模型生态和依赖国产算力的企业客户具有较强吸引力。后续社区关注的焦点将集中在实际跑分表现、推理速度与定价细节上。
