桃子桃子快讯
返回首页
模型发布

OpenAI 发布 GPT-6 Sol 与 Luna,API 价格腰斩直逼 DeepSeek

OpenAI 推出 GPT-6 系列两款新模型,API 价格降至上一代一半,输入 0.1 美元、输出 0.5 美元每百万…

2026.09.23 · 周三8 分钟阅读

OpenAI 正式发布 GPT-6 Sol 与 GPT-6 Luna 两款新模型,API 价格较上一代腰斩,其中 Luna 输入价低至每百万 Token 0.1 美元、输出 0.5 美元,直接进入 DeepSeek V4.1 Flash 的价格区间。这意味着 DeepSeek 长期倚重的低价优势,正面对上一位实力强劲的全球级对手。

三档分工:Astra 守上限,Sol 与 Luna 抢市场

本月早些时候,OpenAI 已发布 GPT-6 Astra,并称其为目前能力最强、对齐程度最高的模型,定位高难度、高价值任务。但其每百万 Token 10 美元输入、50 美元输出的价格,决定了它难以成为日常默认选项。

Sol 与 Luna 承担的是另一项任务。两款模型沿用与 Astra 相近的训练方法,把 Astra 在专业工作、事实准确性、编程、计算机操作和对齐方面的进展,下放到更快、更便宜的产品层级。

  • GPT-6 Sol:面向需要较强推理、编程与 Agent 能力的主流专业任务。
  • GPT-6 Luna:以极低价格承接高频、规模化工作。
  • GPT-6 Astra:继续负责最高能力上限。

API 价格腰斩,输入低至 0.1 美元

本轮降价幅度超出预期:

  • GPT-6 Sol:输入从 4 美元降至 2 美元、输出从 20 美元降至 10 美元(每百万 Token)。
  • GPT-6 Luna:输入从 0.2 美元降至 0.1 美元、输出从 1.2 美元降至 0.5 美元(每百万 Token)。

OpenAI 将降价归因于推理基础设施与缓存效率的提升,目标是直接让利用户。CEO Sam Altman 强调,真正重要的指标是完成一项任务的总花费,并认为在这一维度上目前没有产品能匹敌 Sol 与 Luna。

作为参照,DeepSeek V4.1 Flash 闲时缓存未命中输入价约每百万 Token 1 元、输出 4 元,高峰时段升至 2 元和 8 元。Luna 折合人民币约 0.7 元与 3.5 元,在普通未命中请求上已更便宜且没有峰谷波动。DeepSeek 仍握有 0.10 元 级别的缓存命中输入价,但在主流请求上,OpenAI 已与 DeepSeek 进入同一价格带。

基准测试:在更低单价下追平甚至超越对手

OpenAI 公布的成绩显示,Sol 与 Luna 的主要竞争力集中在专业工作与 Agent 任务:

  • AutomationBench(覆盖销售、营销、运营、客服、财务、人力等业务流程):GPT-6 Sol xhigh 推理强度取得 33.2%,高于 Claude Opus 5 最大推理强度下的 26.9%,但单项任务成本只有后者的 9%。
  • Agents' Last Exam(55 个细分行业的长链专业任务):GPT-6 Sol 最大推理强度 56.4%,超过 Claude Opus 5 在该评测的最高成绩,单项任务成本低约 60%。
  • DeepSWE v1.1(真实代码库软件工程):Sol 最大推理强度 68.8%,距 Claude Fable 5 的 69.9% 仅差 1.1 个百分点,成本低约 80%;DeepSeek V4.1 Flash 同项得分 74.5%。
  • OSWorld 2.0(计算机操作):Sol xhigh 取得 60.5%,与 Claude Opus 5 medium 的 60.3% 基本持平,成本低约 60%。

GPT-6 Luna 在较高推理强度下,以约 1% 的成本追平上一代 Sol;DeepSWE v1.1 上得 66.6%,与 Claude Opus 5、Fable 5 中等推理强度表现相近,成本分别低 93% 和 96%。

OpenAI 还使用用户曾标记事实错误的匿名真实对话进行内部测试,Sol 的错误数量约为上一代的一半,开始接近 Astra 的可靠性。

第三方机构 Artificial Analysis 的 Intelligence Index 与 Coding Agent Index 也给出更克制的观察:两款模型总体智能水平与 GPT-5.6 系列大致持平,部分项目有进有退,真正显著的变化来自成本下降。Sol max 完成 Intelligence Index 单任务成本约 1.06 美元,比上一代的 1.99 美元低近一半;Luna max 约 0.07 美元,比上一代低约 60%。

编程场景:成本成为高频 Agent 的瓶颈

编程是 Sol 的核心场景之一。OpenAI 披露,内部研究人员使用编程 Agent 的规模快速增长,按 API 价格计算,中位数研究人员日均 Token 消耗价值已超 600 美元,第 90 百分位超过 7000 美元。Agent 接手的任务越长,推理成本对使用频率的限制越明显。

在考察代码能否直接合并进真实项目的 FrontierCode 中,Sol 较上一代明显进步,以更低成本追平 Claude Fable 5.1 xhigh。开发者 Flavio Adamo 提前试用后反馈,过去在 GPT-5.6 上通常需要约一小时的任务,如今常可在约 20 分钟内完成,Token 消耗不到原来一半。

不过在视觉品质类任务上,Claude 仍具优势。aipulsedaily 与 Bridgebench 在同提示词对比中认为,Opus 5.5 的场景完整度、相机移动和持续渲染循环更胜一筹。换言之,Sol 与 Luna 的卖点在于用可接受的能力换取数量级上的成本与速度优势,对于单次最佳创意任务 Claude 仍更吸引人,但对于大量 Agent 并发、反复迭代、长期运行的工作流,OpenAI 的价格优势会迅速累积。

缓存机制升级:从单价下降走向体系化省钱

除 Token 单价外,OpenAI 还更新了 GPT-6 的提示词缓存机制:

  • 系统提高默认缓存命中率,缓存输入读取可获 90% 折扣。
  • 开发者可在控制台查看缓存比例与变化,检查未命中缓存的提示词。
  • 推理强度与可用工具可在对话中途调整,同时保留此前上下文缓存。
  • 新增显式断点,允许开发者决定提示词前缀在哪里结束,以优化复用范围。

对持续读取代码库、文档与历史对话的 Agent 而言,缓存节省的费用可能比公开单价下降更重要。

开放节奏与可用范围

GPT-6 Sol 与 Luna 即日起面向 Plus、Pro、Business、Enterprise 与 Edu 用户登陆 ChatGPT Work 与 Codex,Free 与 Go 用户可在桌面应用中使用 Luna。普通 Chat 对话暂未纳入,相关权限将分批开放,Codex 通常会更快。API 用户已可使用 gpt-6-solgpt-6-luna 调用新模型。产品负责人还宣布,Plus、Pro 与 Business 账户将获得一次预存使用额度重置。

DeepSeek 的护城河迎来全球级挑战

DeepSeek 用低价让整个行业重新计算 Token 的价值,OpenAI 则把这种压力带进全球前沿模型的核心战场。Luna 的普通输入输出价格进入 DeepSeek V4.1 Flash 区间后,两者价差被明显压缩;OpenAI 背后还有 ChatGPT Work、Codex 与 API 组成的更完善产品体系,价格接近之后,产品入口、工具支持、运行稳定性与开发者生态都会重新影响选择。低价不会再是某一家公司的招牌,而会成为所有头部模型都绕不开的必答题。

信源