OpenAI 发布 GPT-6 Sol 与 Luna,API 价格腰斩
OpenAI 同日推出 GPT-6 系列两款模型——主打复杂推理的 Sol 与高频低成本的 Luna,API 价格较上代…
OpenAI 于 11 月 16 日同步上线 GPT-6 家族两款新模型——定位「超级大脑」的 Sol 与定位「效率狂魔」的 Luna。两款模型共享 GPT-6 Astra 训练方法所积累的能力,主打不同使用场景,并在 API 端实现 50% 的价格下调,现已面向开发者与 ChatGPT 全量推送。
型号定位:双轨覆盖推理与吞吐
GPT-6 Sol 面向需要深度思考与长链规划的复杂任务,包括代码重构、商业决策以及多步智能体工作流,强调在专业推理与代码生成上的能力上限。
GPT-6 Luna 则定位高频、低延迟、低资源占用的批量处理场景,可用于从长 PDF 中抽取结构化字段、实时翻译海量会话等任务,企业级吞吐场景是核心目标。
API 价格全面腰斩
两款模型的 API 价格均较上一代促销价下调 50%。OpenAI 强调这是永久降价,并非限时折扣。具体每百万 Token 价格变化如下:
- GPT-6 Sol:输入 4 美元 → 2 美元;输出 20 美元 → 10 美元
- GPT-6 Luna:输入 0.20 美元 → 0.10 美元;输出 1.20 美元 → 0.50 美元
价格下降的同时,OpenAI 还强化了缓存机制与底层推理架构,使命中的缓存输入 Token 直接打 1 折,进一步压缩高频调用场景的综合成本。
基准表现:以每任务成本为衡量轴
官方博客几乎以 Claude 系列作为唯一对标对象,并在多张图中以「每任务成本」作为横轴,强调同等分数下的花费优势,关键数据包括:
- AutomationBench:Sol(xhigh)33.2%,单任务成本 0.27 美元,相比 Opus 5 最高分 26.9% 成本下降约 88%
- Agents' Last Exam:Sol 最高档 56.4%,超出 Opus 5 最佳成绩,单任务成本低 60%
- DeepSWE:Sol(max)68.8%,与某竞品最高档 69.9% 接近,成本低 80%;Luna(max)66.6% 追平 Opus 5 中档,成本下降 93–96%
- OSWorld 2.0(离线):Sol 以 20% 成本追平 Opus 5,Luna 以 10% 成本超越上一代 Sol
在事实准确性上,Sol 的事实错误相比上代减少约一半;「欺骗性代码测试」中欺骗率由 10.4% 降至 1.3%,搜索工具失效时的隐瞒行为从 77.5% 降至 4.9%(Luna 由 78.3% 降至 28.7%)。
可用渠道与首批实测
GPT-6 Sol 与 Luna 即日起在 API 中开放,模型标识分别为 gpt-6-sol 与 gpt-6-luna;ChatGPT Work 向 Plus、Pro、Business、Enterprise 与 Edu 用户全量推送;Codex 端同步上线,桌面端 App 向 Free 与 Go 用户开放 Luna 的免费体验。
首批开发者上手测试集中在编程与场景搭建:在 Bridgebench 的火箭发射台生成任务中,Luna 用 65 秒完成、成本 0.01 美元,Sol 用 1 分钟、成本 0.11 美元,均显著低于同期部分竞品。有开发者输入《塞尔达传说:时之笛》预告片段,Sol 直接生成可玩的简化版游戏原型。
官方表示,两款模型允许开发者动态调节推理力度、开关工具,并手动设置缓存断点,全程不打断缓存状态;GitHub 数据显示,在此机制下需重新处理的提示词 Token 占比下降超过 50%。
