桃子桃子快讯
返回首页
行业动态

代号「Doug」曝光:OpenAI 疑重启迄今最大规模预训练

据 SemiAnalysis 与 X 用户爆料,OpenAI 正在推进代号为 Doug 的全新预训练模型,规模为该公司史…

2026.08.10 · 周一5 分钟阅读

8 月 9 日,长期跟踪 OpenAI 模型动向的 X 用户 ChrisGPT 爆料称,OpenAI 正在推进一个代号为「Doug」的全新大型预训练项目,可能在 11 月之前面世。如果消息属实,这将是 OpenAI 自 GPT-4o 之后首次重启真正意义上的全规模基础模型换代。

传闻的来源与脉络

「Doug」并非首次出现在公开讨论中。早在 7 月 9 日的一份研究备忘录中,半导体与 AI 行业研究机构 SemiAnalysis 就曾写道:「OpenAI 已经克服了预训练方面的问题,一个代号为 Doug、规模大得多的模型正在积极推进。」该备忘录在 8 月 7 日关于 Gemini 与 Google Cloud 的文章中被公开引用。

ChrisGPT 在后续回复中进一步补充称,Doug 与 GPT-6 并不是同一个模型,而 GPT-6 很可能就是 OpenAI 因安全问题紧急暂缓发布的代号为 Astra 的模型。也就是说,OpenAI 内部可能同时推进至少两个重要项目:Astra 已经进入高级评测阶段,Doug 则指向更大规模的底座换代。

为什么 Doug 来得关键

要理解 Doug 的分量,需要先回顾 OpenAI 过去两年的训练路线变化。2024 年 5 月 13 日,GPT-4o 发布,被 OpenAI 称为新的旗舰模型。在此后接近两年的时间里,OpenAI 虽然训练并发布了 GPT-4.5 等新模型,但并未完成一轮能够被广泛部署为下一代主力 frontier model 的全规模预训练。

与此同时,模型能力增长开始主要依靠另一条路径。2024 年 9 月 12 日,OpenAI 发布 o1-preview,展示了一种新 scaling 方法:通过大规模强化学习(RL),让模型在推理时投入更多计算。此后,post-training、RL 和 inference-time compute 在 OpenAI 的体系中越来越重要,o3、GPT-5 系列均延续了这一路线。

SemiAnalysis 认为,o1、o3 和 GPT-5 系列实际上仍建立在 GPT-4o 时代的基础模型体系之上,并未发生同等级别的底座换代。这也意味着,过去两年的能力增长,主要由越来越强的后训练与 RL 推动,而非新的预训练。

从 Garlic 到 Doug:底座 scaling 重新启动

2025 年 11 月 18 日,Google 发布 Gemini 3。SemiAnalysis 随后判断,自 GPT-4o 以来,OpenAI 没有完成一轮能够被广泛部署为新 frontier model 的成功全规模预训练。12 月 1 日,多家媒体报道 Sam Altman 在内部宣布「Code Red」,要求团队优先提升 ChatGPT 并重新配置资源。

12 月 2 日,《The Information》报道 OpenAI 正在开发代号为 Garlic 的新预训练模型。据内部消息,Garlic 在 coding 和 reasoning 评测中表现不错,使用了此前训练中发现的多项 bug fixes。OpenAI 首席研究官 Mark Chen 据称向团队表示,公司已解决此前 pre-training 中的一些关键问题。更具前瞻性的一句是:「OpenAI 已经基于 Garlic 学到的经验,开始开发一个 even bigger and better model。」

2026 年 1 月 6 日,SemiAnalysis 再次确认:「OpenAI 已经解决了预训练方面的问题。」从时间线推断,Garlic 更像是验证修复有效性的「小试」,而 Doug 则可能是这些训练方法被真正放大到更大规模后的结果。

真正的看点

如果传闻准确,Doug 要回答的不是 OpenAI 能不能继续 scaling,而是另一个更根本的问题:当底座本身完成一次大幅跃迁之后,这套已经被推到极致的 RL 与推理计算体系,还能把能力再带到哪里。在 Gemini 3 已经把竞争压力摆在台面的背景下,这可能才是 OpenAI 下一轮模型竞争真正的起点。

目前 OpenAI 尚未对 Doug 的存在作出官方确认,上述信息仍来自 SemiAnalysis 的研究备忘录与 X 平台爆料,真实性有待验证。

信源