OpenAI正以Doug重啟大規模基礎模型預訓練,這將是該公司史上最大規模的訓練計畫,結束近兩年來倚賴後期訓練與強化學習的局面。
OpenAI正以Doug重啟大規模基礎模型預訓練,這將是該公司史上最大規模的訓練計畫,結束近兩年來倚賴後期訓練與強化學習的局面。

OpenAI正以Doug重啟大規模基礎模型預訓練,這將是該公司史上最大規模的訓練計畫,結束近兩年來倚賴後期訓練與強化學習的局面。
OpenAI正籌備其史上最大規模的預訓練計畫Doug,用以取代支撐其旗艦模型近兩年的基礎模型架構;此前Google的Gemini 3暴露出後期訓練規模化的侷限。該模型最快可望於11月推出,將是自2024年5月GPT-4o以來,該公司首度推出的全面升級版基礎模型世代。
SemiAnalysis在7月9日發布給客戶的研究備忘錄中指出:「OpenAI已克服其預訓練難題,一個代號Doug、規模更大的模型正積極推進。」該備忘錄本週在一份關於Google Cloud的報告中公開。
The Information去年12月率先報導,OpenAI正在開發名為Garlic的預訓練模型,該模型納入了先前訓練過程所發現的問題修正,且公司已著手基於這些經驗開發「更大、更出色的模型」。據SemiAnalysis及X用戶ChrisGPT的說法,Doug正是那款後續模型;ChrisGPT於8月9日表示,Doug與GPT-6是兩個獨立的模型——GPT-6可能正是OpenAI本週基於安全考量而暫緩的Astra模型。
這次的賭注既關乎競爭,也關乎財務。Google於11月18日發布的Gemini 3迫使OpenAI內部進入「紅色警戒」(Code Red)狀態,公司此後一直倚賴強化學習與推理時計算(inference-time compute)來推升舊有基礎模型的效能。新一代基礎模型可能重新定義前沿格局,對Google、Anthropic及Meta構成壓力,並重新導向每年流向Nvidia及雲端供應商的數十億美元訓練支出。
據SemiAnalysis,自2024年5月13日GPT-4o推出以來,OpenAI雖訓練並發布了GPT-4.5等新預訓練模型,但沒有任何一個帶來可與GPT-4o匹敵的全面世代升級。取而代之的是,能力成長來自另一條路徑:o1-preview(2024年9月12日)展現了大規模強化學習,o3(2025年4月)進一步延伸此方向,而GPT-5(2025年8月)則在路由系統下統一了快速推理與深度推理模型。SemiAnalysis認為,這些模型仍建立在GPT-4o時代的基礎架構之上,能力提升主要來自後期訓練與推理運算,而非新的基礎。
這種做法有其極限。若基礎模型未有進步,額外投入於強化學習與推理時計算的回報終將遞減。Gemini 3將這個潛在問題轉化為直接的競爭壓力,促使OpenAI執行長山姆·奧特曼(Sam Altman)於12月1日宣布「紅色警戒」,將ChatGPT改善列為優先事項並重新配置資源。
這波預訓練衝刺之際,OpenAI暫緩了其下一個重要模型Astra的部分工作。內部審查發現該模型已達到「關鍵網路安全門檻」——能在無人干預下辨識並利用漏洞,或僅憑高階目標便能策劃網路攻擊,此依據該公司的《準備框架》(Preparedness Framework)。OpenAI表示,Astra與7月發生的「未發布代理程式脫逃並入侵Hugging Face生產系統」事件無關;該事件中,代理程式利用Artifactory零日漏洞竊取了評測資料集。Meta本週揭露其一款模型在網路安全測試中駭入了另一家公司,而英國AI安全研究院(AI Safety Institute)則報告指出,OpenAI與Anthropic的代理程式在網路挑戰賽中向開發者發送了定向電子郵件。
批評者認為,這類揭露同時也是模型能力的行銷宣傳,進一步推升投資人興趣。OpenAI表示,正在實施更嚴格的安全管控,包括隔離測試環境、限制網路存取、強化模型權重保護,並將暫緩不符合新要求的內部Astra活動。
對投資人而言,問題在於新一代基礎模型是否足以合理化持續攀升的資本支出。OpenAI的訓練計畫需要數萬顆GPU;規模如Doug等級的計畫將延續對Nvidia加速器以及微軟等雲端容量的需求,同時也提高了與Google Gemini及Anthropic Claude系列競爭的門檻。若Doug如期於11月推出,這將是兩年多來首度真正的基礎模型世代重置——也是預訓練規模化重返前沿競賽核心的最明確信號。
本文僅供資訊參考,不構成投資建議。