桃子桃子快讯
返回首页
模型发布

智谱上线 GLM-5.3,743B 基座模型主打网络安全与编程

智谱 AI 在 ZCode 平台推出 GLM-5.3,CyberGym 基准 84.5 分,号称超越 Mythos 5…

2026.08.14 · 周五3 分钟阅读

智谱 AI 在其 ZCode 平台上悄然上线了新一代模型 GLM-5.3,主打网络防御(Cyber Defence)与代码任务,基座模型规模达到 743B 参数。根据 AI 资讯账号 TestingCatalog 在 X 上披露的消息,GLM-5.3 在 CyberGym 基准测试中取得 84.5 分,官方表述其成绩高于 Mythos 5 与 GPT-5.6 Sol。

核心信息:基准成绩与基座规模

GLM-5.3 在发布时即公布了 CyberGym 上的跑分:

  • 基准:CyberGym
  • 得分:84.5
  • 对比对象:Mythos 5、GPT-5.6 Sol(智谱声称均高于上述两者)

GLM-5.3 是在一个 743B 参数的基座模型上继续训练而来,重点强化网络安全与编程能力。这意味着它并非从零训练的小模型,而是在更大体量的底座上做了任务适配。

定位:Cyber Defence 与 Coding

与此前 GLM 系列偏通用对话与推理的路线不同,GLM-5.3 的卖点明显偏向两个垂直方向:

  • Cyber Defence:在 CyberGym 这类模拟攻防环境里拿高分,目标是真实场景中的漏洞识别、威胁分析等任务。
  • Coding:在编程能力上做了专门训练,与网络安全场景结合后,可用于自动化渗透测试、安全代码审计等流程。

这种「安全 + 编程」的组合,在国内主流大模型里属于差异化定位,对标的多是海外的代码安全专用模型。

发布节奏:API 与开源权重将分阶段开放

智谱在公告中表示,API 接入和开源权重将「在严格安全评估之后分阶段释放」。这意味着:

  • 当前阶段:仅在 ZCode 平台提供使用,尚未全面放开 API。
  • 下一阶段:完成安全评估后逐步开放 API 调用。
  • 后续阶段:视评估结果决定是否以及何时放出开源权重。

这一节奏与智谱此前 GLM 系列的开源策略一脉相承,但措辞更为谨慎,反映出对网络安全类模型的双重用途风险(dual-use)有更高警觉。

行业意义与待观察点

智谱是国内一线大模型厂商,GLM 系列是其主线产品。GLM-5.3 将基座推到 743B 级别,并首次明确切入网络安全这一细分赛道,显示出其在垂直行业模型上的加码意图。

不过,本次披露的信息主要来自 TestingCatalog 的 X 帖子,而非智谱官方完整发布会或技术报告,以下几点仍待官方确认:

  • GLM-5.3 与 GLM-4.5 / GLM-4.6 之间的具体演进关系;
  • 「GPT-5.6 Sol」「Mythos 5」的具体身份与评测口径;
  • 743B 是稠密参数还是 MoE 激活参数;
  • API 与开源权重的具体时间表与许可证类型。

在智谱官方放出完整说明之前,GLM-5.3 目前更像是一次「预告式发布」:基准成绩亮眼、定位清晰,但完整的可用性与技术细节仍待后续披露。

信源