桃子桃子快讯
返回首页
行业动态

OpenAI 新模型 Astra 频繁泄露,或本周发布

OpenAI 下一代模型 Astra 内部代号 mewfour 现身 Codex 仓库,多项信号指向本周发布。

2026.08.18 · 周二5 分钟阅读

OpenAI 下一代旗舰模型 Astra 近期频繁进入公众视野:内部检查点代号 mewfour 再次出现在 OpenAI 官方 GitHub 仓库的 commit 记录中,叠加此前的数学论文与安全声明,外界普遍推测 Astra 或将在本周内正式亮相,预测市场 Polymarket 上相关概率已升至 52%。

代码泄露:代号 mewfour 回归 Codex

开发者 Chetaslua 发现,8 月 7 日 OpenAI 发布 Astra 触及「严重风险等级」声明后约两个半小时,mewfour 代号曾从 52 个 PR 中被清除。但仅 6 天后,这一代号又重新出现在 openai/codex 仓库的 commit 记录中,相关 PR 标注为「独立自动审查」,推理级别设置为 xhigh——目前 Codex 已知最高的思考档位。

从泄露截图看,mewfour 工作的环境已具备会话管理、连接器、技能、插件与自动化流程等完整 AI 工作台元素,正在审查的也是 ChatGPT 即将上线的核心 UI 组件,包括编辑器「+」菜单、连接器与工具权限开关、侧边栏分组排序等。开发者 Haider 通过 commit 时间线推演,认为上线日期指向 8 月 20 日(周四)。OpenAI 研究员 SIGKITTEN 与被称为「义父」的 Tibo 也通过社交媒体释放暗示,但具体含义尚未被破解。

数学论文:2000 美元攻破十个十年难题

8 月 1 日,OpenAI 发布了一篇长达 249 页的数学论文,披露 Astra 的内部版本解决了 10 个长期未取得进展的数学与理论计算机科学难题,覆盖高维几何、编码理论、群论、量子复杂性、格密码学、极值组合学等领域。其中包括首个非 sofic 群的显式构造——这一成果长期被视为群论领域的「圣杯级」问题。

更引人关注的是成本数据:按 GPT-5.6 Sol 的 API 费率(输入 5 美元/百万 tokens,输出 30 美元/百万 tokens)估算,生成全部 10 个解答的 token 成本约为 2000 美元。这意味着困扰学界十年以上的研究突破,可被一次 API 调用以中端笔记本电脑的代价复现。

安全声明:触及网络安全 Critical 阈值

8 月 7 日,OpenAI 发布安全声明称,初步评估显示 Astra 可能已达到其 Preparedness Framework 下的网络安全「Critical」(最高)能力阈值。在该级别下,模型可独立识别并开发多种严重程度的零日漏洞,或针对加固目标制定并执行端到端攻击策略。CEO Sam Altman 随后回应称 Astra 能力非常强大,将先做好安全准备再向所有人开放。

多智能体原生:约 10 万亿参数传闻

据 The Information 此前报道,Astra 被训练为可让多个智能体长时间协同解决复杂问题,传闻参数规模约 10 万亿,采用混合专家(MoE)架构,每个 token 仅激活部分参数,基于内部代号「Doug」的预训练项目构建。该报道还称,Astra 在推理、编码、写作、知识、多模态理解和智能体任务上全面超越 Claude Fable。若属实,这将是首个在预训练阶段就端到端纳入多智能体协作能力的大模型。

目前,OpenAI 已围绕 GPT-5.6 家族搭建起多智能体基础设施:Sol(旗舰)、Terra(性价比)、Luna(最快最便宜)三个模型组成分层协作体系,v2 系统已支持 Sol 与 Terra 并行通信,Codex 上周也将 Luna 纳入作为子智能体。分析师 Dan McAteer 指出,若 Astra 确为多智能体原生预训练,其天生具备的长时程协作能力将使 Codex 能够开箱即用协调多个智能体,把轻量任务分派给更便宜的 Luna——这正是当前架构通过打补丁难以实现的能力跃迁。

待确认与展望

需要指出的是,关于 Astra 的参数规模、MoE 架构细节、多智能体原生训练方式以及对标 Claude Fable 的能力对比,目前主要来自泄露信息与媒体报道,OpenAI 尚未官方确认。代号 mewfour 的反复出现、PR 审查级别的提升,以及官方对 Critical 阈值与数学论文的主动披露,均构成较为连贯的发布前信号,但具体上线时间仍待 OpenAI 正式公告。

信源