OpenAI最大规模预训练模型Doug曝光,或于11月前推出
Claire Weston
OpenAI正在推进代号Doug的史上最大规模预训练项目,预计最迟11月前推出——这是近两年来OpenAI首次尝试真正意义上的底座换代,而非在旧底座上叠加强化学习。
Doug是什么?为什么它不是GPT-6?
X平台用户ChrisGPT于8月9日爆料:OpenAI正在推进代号Doug的新预训练模型,称其为OpenAI迄今规模最大的一次预训练。
Doug与GPT-6并非同一模型。ChrisGPT称GPT-6很可能就是此前因安全问题暂缓发布的内部模型Astra。
这意味着→ OpenAI可能在同时推进至少两轮重要模型项目:已进入高级评测的Astra,以及规模更大的Doug。
为什么OpenAI需要重新做一次大预训练?
2024年5月GPT-4o发布后,OpenAI近两年未完成过一轮能广泛部署的全规模预训练。
o1、o3乃至GPT-5系列的能力增长,主要靠大规模强化学习与推理时计算(inference-time compute,让模型在回答时花更多算力"想一想"再作答)驱动。
用大白话说= 过去两年OpenAI一直在"旧地基上加盖楼层",强化学习把旧底座的潜力榨到了极限,但地基本身没换过。Doug要做的,就是换一块新地基。
Doug的技术血缘从哪来?
2025年12月,《The Information》报道OpenAI开发了代号Garlic的预训练模型,在编程与推理评测中表现不错,并修复了此前训练中发现的一系列问题。
首席研究官马克·陈(Mark Chen)据称向团队确认:此前预训练中的若干关键问题已解决。
2026年1月,研究机构SemiAnalysis再次确认这一进展。用大白话说= Garlic是"试验田",验证修复方案有效;Doug则是把这些方法放大到更大规模后的产物。
SemiAnalysis扮演了什么角色?
早在7月9日,SemiAnalysis已在发给机构客户的研究备忘录中写道:OpenAI已克服预训练问题,代号Doug的更大模型正在积极推进。
该备忘录于8月7日随一篇讨论Gemini与谷歌云的文章对外公开,比ChrisGPT的爆料早两天。
这反映出 Doug并非突然曝光——行业研究机构的信息链至少可以追溯到一个月前。
Doug真正要回答的问题是什么?
过去两年已证明:旧底座通过强化学习和推理时计算,仍可持续提升能力。
Doug要回答的是下一层问题:当底座本身完成一次大幅跃迁后,那套已被推至极限的后训练体系,还能将能力带到多远?
这意味着→ Doug的表现不只决定一个模型的好坏,而是决定OpenAI在下一轮模型竞争中的真实起点——新地基能否撑起更高的楼。
Content is for reference only, not financial advice.