輝達(NVDA-US) 正加大對開放權重人工智慧(AI)模型的布局。據知情人士透露,輝達本週與AI新創Poolside達成一項總值60億美元的技術授權協議,並將吸收該公司大批工程師,目標是打造全球最強大的開放權重AI模型之一,進一步挑戰中國DeepSeek、Kimi K3等模型,同時也可能與OpenAI、Anthropic等美國AI龍頭形成更直接的競爭關係。
根據《華爾街日報》報導, Poolside的致股東信指出,輝達將以投前120億美元估值投資Poolside 10億美元,另外支付60億美元取得該公司的技術授權,並延攬大部分工程團隊。
Poolside創辦人Eiso Kant與前GitHub技術長Jason Warner在信中表示,這項交易的目標之一,是讓未來的通用人工智慧(AGI)不會成為少數企業封閉掌控的技術,而是能夠以開放方式由更多人共同建立。
根據知情人士說法,超過100名Poolside員工,包括工程師在內,將加入輝達,並投入輝達自2023年開始發展的Nemotron開放權重模型計畫,協助開發其中規模最大、技術最複雜的模型。
不過,Poolside管理團隊並不會加入輝達。包括Kant、Warner以及營運主管Margarida Garcia在內的公司高層,將繼續從事尚未公開的研究工作。
輝達加碼開放權重AI 正面挑戰中國模型
開放權重模型可以免費下載,開發者也能根據特定需求進行修改,因此通常具備較低的使用成本與更高的客製化彈性。
相較之下,目前美國AI產業投入更多資源發展的是封閉式模型。OpenAI、Anthropic以及Google(GOOGL-US) 等業者的主要模型,均不會向開發者公開完整的模型權重或原始碼。
這也逐漸成為美中AI競爭中的一項重要問題。由於美國AI公司過去並未將開放式模型置於最高優先位置,市場開始擔心,全球企業與國家可能轉向中國開發的開放權重模型。
輝達執行長黃仁勳長期支持開放權重模型,而近半年來,公司更明顯加快相關布局,試圖因應中國開放模型快速崛起的趨勢。
今年3月,輝達成立Nemotron Coalition,集結Mistral、Thinking Machines Lab及Perplexity等主要開放模型開發商。輝達表示,成員將共享資料、專業知識及運算資源。
同月,《華爾街日報》報導,另一家獲輝達支持、並參與Nemotron Coalition的新創Reflection AI,因其先進的開放權重模型而被投資人形容為「西方的DeepSeek」,當時正進行一輪大規模募資談判,計畫以250億美元估值籌募25億美元。
黃仁勳上月也首次在社群平台X發文,並發布題為「Open Weights and American AI Leadership」的公開信,強調美國能否贏得AI競賽,關鍵不在於單一最先進AI模型,而在於能否建立一個強大的開放生態系,並將AI技術擴散至各個產業。
DeepSeek掀起震撼 輝達押注開放模型競賽
中國AI模型的快速崛起,是輝達加速布局開放權重AI的重要背景。
2025年1月,DeepSeek發布首款低成本開放權重模型,引發美國科技股劇烈震盪。市場當時將其視為中國AI技術快速追趕美國的訊號,創投家Marc Andreessen更形容這是AI領域的「史普尼克時刻」(Sputnik moment)。
此後,美中AI競賽持續升溫。中國陸續出現新的AI業者,並開發出與美國最先進AI技術差距僅數個月的開放模型,其中包括Moonshot旗下的Kimi,以及Z.AI的GLM系列模型等。
如今,輝達透過取得Poolside技術授權並延攬其大部分工程人才,押注在未來一年內打造出能與全球頂尖AI模型競爭的Nemotron版本。
本月稍早,輝達發布 Nemotron 3.5 Lightning,這是一款較為「輕量化」的開放權重模型,目前公司也正在開發該系列迄今規模最大的版本。
市場傳聞,這款最大版本的訓練參數可能超過1兆個,使其躋身史上規模最大的人工智慧(AI)模型之列。不過,目前仍有部分中國開放權重模型的規模更大。
此外,與Poolside的交易也讓輝達面臨一項微妙的競爭關係。目前OpenAI、Anthropic等大型AI實驗室不僅是輝達最重要的AI晶片客戶之一,同時也是封閉式AI模型的主要開發商。隨著輝達開始自行強化Nemotron等開放權重模型,雙方的合作關係也可能逐漸加入競爭因素。
此外,輝達支持的其他開放模型開發商也可能與Nemotron形成競爭。
部分專家指出,大型AI實驗室本身也正在開發客製化AI晶片,用於支撐旗下模型的訓練與運算,因此這些企業與輝達之間其實早已存在一定程度的直接競爭。
Poolside曾因算力資金不足陷入困境
值得注意的是,Poolside與輝達雖然早已有合作關係,但這次交易是在最近幾週內快速敲定。
輝達向Poolside提出投資及技術授權交易的時間,恰逢這家新創公司發布最新模型「Laguna S」前後。該模型已成為西方市場最受歡迎的開放權重模型之一。
Poolside發布的股東信也提到,公司2025年曾經歷一次募資失敗,這場挫折促使公司重新檢視自身發展方向,並間接促成與輝達的這筆交易。
信中寫道:「去年年底,我們有6週的時間籌集20億美元,用於支付一座將於1月啟用、配備4萬顆GB300的運算叢集。」其中,GB300是輝達常見的AI模型訓練伺服器類型。
Poolside表示,公司未能在期限內完成募資,因此失去了這座運算叢集。
Poolside管理層在信中表示,公司「重新振作,回到工作崗位」,但很快便意識到,如果無法取得所需資金及資料中心資源,公司的運算能力最快可能在明年就會耗盡。
Poolside在信中指出,輝達是理想的合作夥伴,其中一項原因在於,輝達面臨的運算基礎設施及現金限制相對較少。
