桃子桃子快讯
返回首页
行业动态

基准测试显示 GLM-5.3 Flash 与 GPT-5.6 Terra 得分持平,成本低 82%

据 Artificial Analysis 智能指数,GLM-5.3 Flash 与 GPT-5.6 Terra 得分相…

2026.09.08 · 周二2 分钟阅读

第三方 AI 评测机构 Artificial Analysis 的「智能指数」(Intelligence Index)显示,智谱的 GLM-5.3 Flash 与 GPT-5.6 Terra 在该综合基准上取得了相同的得分,但 GLM-5.3 Flash 的单任务成本仅为后者的约 18%,即便宜 82%。该对比数据由 AI 基础设施平台 Together AI 在 X 上转发披露。

基准与对比口径

Artificial Analysis 的智能指数通常综合推理、代码、数学、知识问答等多维度能力进行加权打分,是业内较受关注的第三方评测之一。本次对比中两款模型在指数层面的得分完全一致,意味着在评测覆盖的能力范围内,它们的综合表现处于同一水平。

值得注意的是,Flash 版本通常定位为面向高吞吐量、低延迟场景的轻量化档位,与主打高能力的旗舰版本在能力上往往存在差距;此次 Flash 与 GPT-5.6 Terra 打平,意味着 GLM 在「性价比」维度的竞争力较为突出。

成本差距的量级

按披露口径换算,若以 GPT-5.6 Terra 的单任务价格为基准 100,则 GLM-5.3 Flash 的单任务价格约为 18,相当于在保持同等智能指数表现的前提下,将单位任务成本压缩至不到原来的五分之一。对于大规模调用、对成本敏感的企业用户与开发者而言,这一价差足以显著改变模型选型的优先级。

需要进一步确认的信息

目前公开信息中尚未披露以下关键细节:

  • 智能指数的具体分数与各子项得分;
  • 对比的输入/输出价格区间、计费单位(如每百万 token)以及是否包含缓存或批处理折扣;
  • 测评时使用的具体版本、采样参数与上下文长度。

在缺少上述细节的情况下,「82% 更便宜」的结论应以官方价格表与 Artificial Analysis 原始报告为准,避免直接套用到实际生产环境的成本估算中。

小结

如果这一对比结果经进一步核实,GLM-5.3 Flash 将在「同档智能水平、更低成本」的象限占据明显位置,为预算受限的团队提供了一个可与 GPT 系列正面对照的备选项;但鉴于目前披露的信息仅来自一条社交媒体帖文,建议读者持续关注 Artificial Analysis 与模型厂商的官方更新,以获得更完整的能力与定价数据。

信源