行业动态
Meta AI 模型在五项 STEM 奥赛中取得金牌级成绩
Meta AI 宣布其模型在 APhO、IPhO、IMO、IChO、RMM 五项国际 STEM 奥赛中表现优异,且全程禁…
2026.08.06 · 周四约 2 分钟阅读
Meta AI 于 X 平台发布消息,称其人工智能模型在五项国际 STEM 奥林匹克竞赛中取得金牌或更高水平的成绩,涵盖物理、数学、化学三个学科,且测试过程全程禁用搜索、代码执行与计算器等外部工具,以检验模型的纯推理能力。
五项赛事成绩
Meta AI 给出的具体成绩如下:
- 亚洲物理奥林匹克(APhO):理论考试满分
- 国际物理奥林匹克(IPhO):理论考试满分
- 国际数学奥林匹克(IMO):金牌
- 国际化学奥林匹克(IChO):金牌级表现
- 罗马尼亚大师赛数学(RMM):金牌级表现
官方特别强调,奥赛题目对深度推理链、创造性洞察与严谨论证能力要求极高,正适合用于检验模型在纯推理维度的真实水平。
测试方式与限制
为避免工具辅助带来的偏差,Meta AI 在此次评测中明确禁止任何外部工具使用:不调用搜索引擎、不执行代码、不使用计算器。这意味着模型需要依靠自身能力完成符号运算、逻辑推导与多步推理。这与近年来业界逐步把推理能力作为独立评估维度的趋势一致。
行业背景与待解疑问
自 OpenAI、Google DeepMind 等陆续公布自家模型在 IMO、Putnam 等高水平数学赛事上的成绩后,顶级奥赛正成为衡量前沿模型推理能力的新「试金石」。Meta AI 此番一次性覆盖物理、数学、化学三类赛事,是其在通用推理维度上的一次集中展示。
不过官方消息中并未透露具体参评模型名称、版本号、题目数量、得分细节及评判标准等关键信息,也未说明是否经过独立第三方验证。对于希望复现或横向比较的研究者而言,目前可依据的细节仍然有限。
