桃子桃子快讯
返回首页
模型发布

GPT-6 Astra 正式发布,OpenAI 称其为全球最强模型

Sam Altman 在 X 宣布 GPT-6 Astra 发布,在 FrontierMath、ARC-AGI 3、Ex…

2026.09.04 · 周五3 分钟阅读

OpenAI 首席执行官 Sam Altman 今日通过 X 平台宣布,新一代旗舰大模型 GPT-6(代号 Astra)正式发布。OpenAI 称其为「目前全球最强」的通用模型,在计算机使用、专业工作、科学研究、编程以及网络安全等多个关键能力维度上实现突破,并强调模型在发布前经过了额外的安全与对齐审查,以确保其能力水平符合相应标准。

核心定位与能力

Altman 在声明中表示:「我们希望它能够开启新一代的创业、科学发现与产品构建。」OpenAI 将 GPT-6 Astra 定位于「计算机使用」场景,即模型直接操作界面、软件乃至操作系统完成任务的能力,这一交互范式被视为 AI Agent(智能体)落地的关键路径。

除计算机使用外,官方还强调其在专业办公、科学研究、代码编写与网络安全等场景的领先性。这意味着 GPT-6 并非单一能力跃升,而是面向多类高复杂度任务的综合型旗舰。

关键基准表现

GPT-6 Astra 在三项高难度基准测试中取得接近或达到满分的成绩:

  • FrontierMath Tier 4:98%
  • ARC-AGI 3:99.9%
  • ExploitBench:100%

其中,FrontierMath 是衡量前沿数学推理能力的标杆测试,长期被视为通用模型难以逾越的关卡;ARC-AGI 系列专注于抽象推理与通用智能评估;ExploitBench 则衡量模型在网络安全攻防中的真实利用能力。三项成绩同时接近或达到极限,暗示 GPT-6 在推理、规划与对抗性任务上均出现显著跃迁。

安全与对齐考量

Altman 特别提到,团队「多花了一些时间」以确保模型达到该能力水平所对应的安全与对齐标准。这一表述与近期业界对前沿模型风险评估趋严的趋势一致,也意味着 GPT-6 上线前或已通过更严格的内部红队测试与能力评估流程。

行业意义与待披露信息

作为 OpenAI 的下一代旗舰,GPT-6 的发布将对全球大模型竞争格局、AI Agent 赛道以及企业级 AI 应用产生直接影响。尤其在「计算机使用」这一方向上的领先,若得到实际验证,可能加速 Agent 类产品在办公自动化、软件开发与安全运营等场景的落地。

截至目前,OpenAI 尚未公开 GPT-6 Astra 的完整技术报告、上下文窗口、定价策略、API 开放时间表以及多模态能力的具体细节,更多信息预计将在后续官方渠道陆续披露。

信源