動機)
昨天還在聊Astra主動踩剎車今天又炸出一個更大的瓜。8月9日長期跟蹤OpenAI的X用戶ChrisGPT爆料了一個代號叫Doug的模型。按他的說法這是OpenAI迄今為止規(guī)模最大的一次預(yù)訓(xùn)練項目而且——它不是GPT-6。GPT-6大概率就是正在安全審查中的Astra預(yù)計8月發(fā)布。而Doug是另外一張牌最遲可能11月亮相。這不是孤例。早在7月9日半導(dǎo)體行業(yè)研究機構(gòu)SemiAnalysis就在發(fā)給付費客戶的備忘錄里提到過Doug原話是OpenAI已經(jīng)克服了預(yù)訓(xùn)練方面的問題一個代號為Doug、規(guī)模大得多的模型正在積極推進(jìn)。來源SemiAnalysis兩個獨立消息源對上了這件事就不只是又一個爆料了。它真正值得說的地方在于OpenAI的底座兩年多來可能第一次真的要換代了。一、OpenAI的發(fā)動機已經(jīng)兩年沒換了先把時間往回?fù)堋?024年5月GPT-4o發(fā)布。那是OpenAI最后一次完成真正意義上的全規(guī)模預(yù)訓(xùn)練換代——從GPT-4的底座換到一個全新的、更大的基礎(chǔ)模型。之后發(fā)生了什么2024年9月o1-preview發(fā)布。它的核心突破不是更大的預(yù)訓(xùn)練而是強化學(xué)習(xí)推理時計算——模型學(xué)會了在回答問題時多想幾步用更多的推理時間換更好的答案。2025年4月o3發(fā)布同樣是強化學(xué)習(xí)驅(qū)動。2025年8月GPT-5發(fā)布變成了快速模型深度推理模型路由系統(tǒng)的組合架構(gòu)但底層底座的代際躍遷并沒有明確證據(jù)表明達(dá)到了GPT-4o那個級別的全規(guī)模預(yù)訓(xùn)練換代。SemiAnalysis有一個很有影響力的判斷從GPT-4o至今OpenAI沒有完成一輪能夠被廣泛部署為下一代主力前沿模型的成功全規(guī)模預(yù)訓(xùn)練。來源36氪/機器之心這話有點繞翻譯成大白話就是OpenAI過去兩年多的能力增長主要靠的是后訓(xùn)練post-training、強化學(xué)習(xí)RL和推理時計算inference-time compute而不是基礎(chǔ)模型本身的換代。就像一輛車發(fā)動機沒換但調(diào)校越來越極致——ECU刷了一階又一階懸掛改了一套又一套輪胎從街胎換到半熱熔確實越來越快但發(fā)動機的底子還是那個。中間不是沒試過。Orion等項目據(jù)說因為表現(xiàn)不及預(yù)期被降級了。全規(guī)模預(yù)訓(xùn)練遇到了瓶頸可能是訓(xùn)練穩(wěn)定性問題可能是scaling到一定規(guī)模后面臨性能退化也可能是數(shù)據(jù)和算力的邊際收益在下降??傊鬃@條路卡住了。二、從Garlic到Doug預(yù)訓(xùn)練之墻是怎么被打破的轉(zhuǎn)折點大概在去年年底。2025年11月Google發(fā)布Gemini 3。然后12月初Sam Altman在內(nèi)部宣布Code Red要求團(tuán)隊優(yōu)先提升ChatGPT并重新配置資源。幾乎同時The Information報道了一個代號叫Garlic的新預(yù)訓(xùn)練模型。報道里有兩個關(guān)鍵信息Garlic在代碼和推理評測中表現(xiàn)不錯首席研究官Mark Chen告訴團(tuán)隊公司已經(jīng)解決了此前預(yù)訓(xùn)練中的關(guān)鍵問題 來源The Information更值得注意的是同篇報道里的一句話OpenAI已經(jīng)基于Garlic學(xué)到的經(jīng)驗開始開發(fā)一個even bigger and better model。那個更大更好的模型很可能就是Doug。Garlic像是一次驗證——證明新的訓(xùn)練方法確實有效之前卡住的瓶頸真的被解決了。而Doug是把這些修復(fù)和改進(jìn)放大到更大規(guī)模之后的產(chǎn)物。到了2026年1月SemiAnalysis直接說OpenAI已經(jīng)解決了預(yù)訓(xùn)練方面的問題。7月的備忘錄里Doug的代號正式出現(xiàn)。8月ChrisGPT把它公之于眾。這條時間線串起來邏輯是通的Garlic驗證→ Doug全規(guī)模放大→ 底座scaling重新啟動如果這一切屬實那意味著什么意味著scaling laws在預(yù)訓(xùn)練維度上遠(yuǎn)沒有到天花板。過去兩年大家看到的預(yù)訓(xùn)練停滯、推理計算崛起不是scaling laws失效了而是OpenAI暫時卡在了工程問題上?,F(xiàn)在問題解決了底座重新開始往上堆。o系列證明了推理時計算可以持續(xù)scaling。Doug如果成功就證明了預(yù)訓(xùn)練本身也還能繼續(xù)scaling。兩條路都通了。三、為什么是兩張牌而不是一張這里有個很有意思的布局Astra可能的GPT-6和Doug不是一個項目的兩個階段而是兩條并行的線。Astra走的是智能體/深度推理路線。它被暫停的原因是關(guān)鍵網(wǎng)絡(luò)能力——具備自主在網(wǎng)絡(luò)上行動的能力安全框架直接觸發(fā)了Critical級別的暫停。它的核心看點是Agent能力的邊界。Doug走的是底座scaling路線。它的核心看點是基礎(chǔ)模型本身的代際躍遷。ChrisGPT的說法很有戲劇性Doug一旦出來Anthropic的Fable都會顯得原始。來源鳳凰網(wǎng)/新智元當(dāng)然這是爆料人的說法聽聽就好。但從產(chǎn)品策略的角度OpenAI手里壓兩張牌的邏輯很清楚Astra/GPT-68月打當(dāng)下的仗。對標(biāo)Anthropic即將發(fā)布的Fable 5.1守住智能體和深度推理的陣地給用戶一個下一代模型的明確感知。Doug年底/11月打下一輪的仗。用真正的底座換代重新拉開差距把競爭從后訓(xùn)練調(diào)校的層面拉回基礎(chǔ)模型規(guī)模的層面。甚至有分析認(rèn)為Doug可能使用了英偉達(dá)尚未全面鋪開的下一代Vera Rubin芯片進(jìn)行訓(xùn)練——如果是真的那這就是新芯片新訓(xùn)練方法新底座的三重?fù)Q代。來源AIbase這個節(jié)奏像什么像iPhone的S年和數(shù)字年交替——數(shù)字年換外觀換芯片S年打磨體驗加功能。OpenAI現(xiàn)在的操作是把兩條線并行跑了一條線持續(xù)迭代現(xiàn)有體系另一條線偷偷憋下一代底座。等Astra的熱度過去Doug接棒。四、三巨頭變兩強scaling的下半場剛開場把視野再拉大一點。就在8月5日Google的AI版圖塌了一角。Jeff Dean——干了27年的首席科學(xué)家、Transformer時代的關(guān)鍵人物——帶著三位核心研究員出走創(chuàng)業(yè)。同一天哈薩比斯卸任DeepMind CEO退居董事長。Alphabet股價當(dāng)天跌超4%。曾經(jīng)的ASI三巨頭OpenAI、Anthropic、Google DeepMind現(xiàn)在DeepMind越來越不像一個前沿玩家了。發(fā)明Transformer的地方正在給對手輸送人才。賽道上剩下OpenAI和Anthropic正面剛。Anthropic手里的牌是Fable 5以及即將到來的Fable 5.1。他們的路線很穩(wěn)持續(xù)推進(jìn)預(yù)訓(xùn)練規(guī)模Fable系列已經(jīng)走到了業(yè)界最前沿的位置。OpenAI手里的牌更復(fù)雜GPT-5.5/5.6系列在快速迭代Astra在安全審查中現(xiàn)在又多了一個Doug。過去兩年他們用后訓(xùn)練推理計算這條路證明了自己能打現(xiàn)在如果底座再追上來甚至反超那就是雙引擎全開。這才是Doug這個爆料真正的行業(yè)意義——它不只是OpenAI又要出一個大模型。它是一個信號AI能力的增長即將從單引擎驅(qū)動切換到雙引擎驅(qū)動。過去兩年主要是推理時計算和強化學(xué)習(xí)在推著能力往前走。接下來如果底座換代成功預(yù)訓(xùn)練和后訓(xùn)練會同時往上推。11會等于幾沒人知道。但有一點是確定的當(dāng)一個已經(jīng)被推到極致的后訓(xùn)練體系遇上一個換代后的新底座疊加出來的能力上限不會是簡單的加法。結(jié)尾回頭看這兩年挺有意思的。GPT-4o之后很多人說scaling laws到頂了以后要靠算法創(chuàng)新。o1出來之后很多人說預(yù)訓(xùn)練不重要了以后是推理時計算的天下?,F(xiàn)在Doug的消息出來劇情又反轉(zhuǎn)了——不是預(yù)訓(xùn)練不行是OpenAI暫時卡住了現(xiàn)在通了。技術(shù)的發(fā)展從來不是單線程的。一條路走到瓶頸不代表這條路就到頭了可能只是工程問題還沒解決。等問題解決了這條路還能繼續(xù)往前走。OpenAI的發(fā)動機兩年多沒換了。如果Doug真的是換代那接下來的半年會很熱鬧。Astra只是開胃菜。真正的主菜可能在年底。參考來源SemiAnalysis: Gemini is cooked, but GCP is cooking36氪/機器之心剛剛OpenAI最大預(yù)訓(xùn)練模型Doug曝光鳳凰網(wǎng)/新智元OpenAI曝光GPT-6!傳10萬億參數(shù)8月強行發(fā)布AIbase: Report: GPT-6 Exposed with 10 Trillion Parameters; OpenAI May Have a Bigger Weapon by Year-End, DougThe Information: OpenAI Developing Garlic Model to Counter Google