輝達押注280億美元,相信開源AI模型將把GPU需求擴展至少數前沿實驗室之外。
輝達押注280億美元,相信開源AI模型將把GPU需求擴展至少數前沿實驗室之外。

輝達正在開發Nemotron 4,這是一款至少擁有1萬億參數的開源AI模型——是目前最大型號參數量的兩倍——這家晶片製造商正尋求將GPU需求擴展至少數前沿實驗室和雲端服務供應商之外。
「輝達投資Nemotron,是因為我們相信每一家企業、每一個國家都需要可取得的頂尖開源模型,」輝達生成式AI副總裁Kari Briski在電郵中表示。
據The Information報導,該模型的參數量將約為6月發布的Nemotron 3 Ultra的兩倍,設計目標是在全球最佳開源模型中一較高下。輝達已承諾在2031年初前簽訂多年期雲端服務協議,總金額達280億美元——約為一年前披露金額的三倍——其中約70億美元分配至截至2028年1月的當前財年。輝達上一代主要模型的研究論文列有570位作者;員工表示Nemotron 4涉及的人數更多。
這項戰略存在結構性張力。輝達已向OpenAI投資300億美元,而OpenAI是其最大的晶片客戶之一,同時Nemotron 4被定位為前沿模型的低成本替代方案。但輝達的賭注在於,一個更活躍的開源社群將從整體上推動更多GPU需求。「無論哪家公司做出優秀的開源模型,輝達都是贏家,」模型評測公司Arena執行長Anastasios Angelopoulos表示。
為加速開發進程,輝達組建了一個名為「Nemotron Alliance」的網路,參與者包括Reflection、Cursor、Thinking Machines和Mistral——這些開源開發者在推進自身項目的同時,為輝達貢獻訓練資料、評測支援和模型設計構想。據一位直接參與合作的知情人士透露,AI模型訓練新創公司Prime Intellect已為模型訓練貢獻了30萬個模擬環境。AI程式碼工具新創公司Cognition已與輝達討論提供程式碼訓練資料,不過該合作夥伴關係尚未公開宣布。
聯盟成員各有不同的動機。有些人希望透過輝達對開源AI的推動來擴大自身市場份額;另一些人則希望影響一款高品質模型的發展方向,以便在不承擔訓練運算成本的情況下使用它。Prime Intellect執行長Vincent Weisser將該聯盟定位為針對單一「神級」模型壟斷的集體行動,而非爭奪最佳開源模型頭銜的零和競賽。
輝達的開源戰略已引起華盛頓方面的關注。輝達執行長黃仁勳於7月底在X平台發布了他的第一條訊息,捍衛開源模型,稱其「能強化安全性和網路安全、加速創新與擴散,並實現主權」。此前,中國的Moonshot AI發布了Kimi K3,該模型縮小了與美國領先模型之間的差距,促使政策制定者質疑是否應對中國開發者實施類似於晶片出口管制的制裁。
輝達本週發布了Nemotron 3.5 Lightning,這是一款較小的模型,設計用於在PC的單一GPU上執行AI代理任務。輝達還推出了NeMo Switchyard,這是一款免費軟體,可將AI任務路由至最具成本效益的模型。包括CrowdStrike、CodeRabbit和Harvey在內的企業已對新模型進行了測試和客製化。
輝達現有的Nemotron模型已獲得一定的市場接受度。Palantir於6月宣布,將為美國政府客戶使用Nemotron模型。但來自Arena和Artificial Analysis的基準數據顯示,Nemotron 3 Ultra在美國開源模型中排名第二,落後於Thinking Machines的Inkling,且在全球排名前40名之外。
Nemotron 4的時間表仍不確定。員工表示,輝達已就預訓練資料和架構做出決定,但尚未敲定具體規格或發布日期,而最終訓練——預計需要數月時間——尚未開始。兩名員工表示,該模型最早可能在深秋推出;其他人則預計會更晚。輝達應用深度學習研究副總裁Bryan Catanzaro於1月表示,投資Nemotron「對我們公司的未來至關重要」。
消息公布後,輝達股價在盤前交易中上漲近2%。如果Nemotron 4成功將GPU運算的可及市場擴大至前沿實驗室之外,它可能降低輝達對集中客戶基礎的依賴——但同時也存在透過與這些客戶的商業模型直接競爭而疏遠他們的風險。
本文僅供參考,不構成投資建議。