DeepSeek傳下單16萬顆華為AI晶片!靠規模挑戰輝達

中國AI新創深度求索(DeepSeek)計畫在內蒙古興建的大型資料中心部署至少16萬顆華為新一代AI加速器,有望打造目前已知規模最大的華為晶片叢集之一,進一步推動中國以國產晶片取代輝達(NVDA-US)的進程。

《彭博》周五(4日)引述知情人士報導,DeepSeek準備採購華為昇騰950DT晶片,用於執行AI模型,但實際安裝時間將取決於華為的產能。儘管華為將950DT定位為可支援訓練等高負載工作的處理器,DeepSeek目前沒有使用這款晶片訓練模型的計畫。

DeepSeek過去曾嘗試使用華為晶片訓練模型,但目前在這項關鍵工作上仍依賴輝達加速器。相較之下,執行已完成訓練的AI模型、也就是推論工作,對晶片效能及軟體生態的要求相對較低,因此成為中國業者導入國產晶片的重要切入點。

DeepSeek與華為均未對消息置評。

華為產能不足 交付16萬顆晶片恐耗時逾一年

知情人士透露,DeepSeek希望採購更多華為高階晶片,但華為目前沒有足夠產能。高階記憶體等關鍵零組件短缺,將使華為今年950DT產量受限於數十萬顆的低段水準。

由於華為還必須滿足其他客戶需求,並嘗試向海外出口少量產品,因此完成DeepSeek訂單可能需要超過一年。DeepSeek已要求北京協助,希望促使華為更快分配更多晶片給該公司。

若依照規畫完成,內蒙古資料中心將成為DeepSeek發展AI的核心設施。公司正洽談籌集數十億美元,以擴充運算基礎建設。整個計畫將達到1吉瓦規模,全負載運轉時消耗的電力,約足以供應75萬戶家庭使用;16萬顆昇騰950DT僅占整體運算容量的一部分,其餘設施將採用哪些晶片仍不清楚。

中國現有公開的華為晶片叢集規模遠小於這項計畫。深圳官方媒體約半年前才宣布,當地啟用中國首座由1萬顆昇騰晶片構成的智慧運算叢集。美團(3690-HK)6月表示,曾使用5萬顆國產晶片訓練AI模型;Z.AI則完成一座1吉瓦資料中心,但目前安裝的國產加速卡約為1萬張。

相較之下,馬斯克旗下SpaceXAI早在2024年便啟用規模達10萬顆晶片的運算叢集。DeepSeek若成功部署16萬顆華為晶片,規模將開始接近西方科技公司 routinely興建的大型資料中心,儘管中國國產處理器的個別效SSA能仍相對落後。

美國管制催生國產替代 DeepSeek訓練仍仰賴輝達

華為昇騰950DT約在一年前亮相,效能被普遍認為可與輝達上一代Hopper架構晶片相比。華為據報計畫2026年生產約160萬顆昇騰晶粒,足以製造約60萬顆主力910C晶片及少量其他型號,但美國出口限制仍對其產量與效能形成制約。

輝達長期主導AI模型訓練及推論市場,但其高階晶片未經美國政府許可,大多不得銷往中國。輝達曾批評,美國自2022年起實施的出口管制,正在迫使中國加快發展國產晶片,反而催生本土替代供應鏈。

北京也持續要求中國AI實驗室改用國產硬體,但民營企業仍普遍偏好輝達產品。川普政府放寬部分限制後,阿里巴巴(BABA-US)(09988-HK)與騰訊(00700-HK)等業者便下達大量訂單;中國企業也能租用設於海外的運算資源,間接取得輝達高階晶片算力。

川普政府官員曾指控DeepSeek及月之暗面(Moonshot AI)使用走私的輝達晶片發展AI,並稱DeepSeek已取得Blackwell晶片、安裝於內蒙古,但目前尚無法獨立證實相關說法。

美方一度準備允許中國採購多達100萬顆輝達H200晶片,但北京目前僅核准其中少部分進口。DeepSeek大舉採購華為晶片,顯示即使國產硬體尚難完全取代輝達,中國仍試圖透過建立超大型叢集,以規模彌補單顆晶片的效能差距。