行业动态
Mollick 谈 GLM-5.3:开源权重模型需配齐模型卡与红队测试
沃顿教授 Mollick 在 X 上表示 GLM-5.3 是个好模型,但开源权重模型必须公开模型卡并做红队测试。
2026.08.29 · 周六约 2 分钟阅读
沃顿商学院教授、AI 研究者 Ethan Mollick 近日在 X 平台发帖,谈及智谱新近发布的 GLM-5.3 模型及其代表的开源权重模型生态。Mollick 认为 GLM-5.3 本身是一个表现优秀的模型,但随着开源权重模型的能力持续提升,模型的发布与治理方式必须同步跟进。
Mollick 的核心观点
Mollick 在帖子中强调了两项他认为开源权重模型发布时必须配套完成的工作:
- 模型卡(model card):系统披露模型的训练数据、能力边界、已知局限与潜在风险,让使用者对模型行为有清晰预期;
- 红队测试(red teaming):主动寻找可被滥用的漏洞和绕过护栏的方法,并将结果向社区公开。
他指出,任何开源模型的护栏最终都可以被绕过,因此仅仅声称「模型是安全的」并不够,关键是要让使用者和监管方了解具体存在哪些风险,从而自行做出判断和防护。
背景与意义
Mollick 的评论虽以 GLM-5.3 为引子,但讨论的是开源权重模型生态中普遍存在的治理缺口。近年来,GLM、Llama、Qwen、Mistral 等系列的开源权重模型在性能上不断逼近闭源前沿模型,开发者社区在享受更高自由度的同时,也面临缺乏统一安全披露规范的现实。
- 模型卡和红队测试报告已成为衡量开源模型成熟度的重要参考;
- 主流厂商如 Meta、Google 等在发布开源权重时已逐步规范化这些文档,但中小厂商与新晋团队的执行水平参差不齐。
Mollick 的呼吁可以被视为对整个开源权重生态的一次温和提醒:在「能力追赶」的同时,「安全披露」同样不可缺席。
