16 萬顆晶片放在內蒙古
彭博 9 月 4 日引述知情人士報道,DeepSeek 計劃在內蒙古興建中的數據中心,部署至少 16 萬顆華為 Ascend 950DT 晶片。CNBC TV18 同日跟進,指這個項目一旦建成,將是已知規模最大的華為 AI 晶片集群之一,也是中國擺脫 Nvidia 依賴的一次重要試驗。
這個數據中心並非新消息。彭博 7 月 30 日已報道,DeepSeek 正在距離北京西北約 350 公里的烏蘭察布興建一座 1GW 級數據中心,屬於國家「東數西算」布局的一部分,目標是 2027 年底或 2028 年初讓部分產能投入運作。當時報道特別提到,晶片選擇仍未落實:Nvidia 是全球 AI 數據中心的標準配備,華為是中國的替代選項。這次的報道等於補上了答案。

只用來推理,不用來訓練
報道中最值得留意的細節,是這批晶片的用途。DeepSeek 打算用 Ascend 950DT 來運行模型,即所謂推理(inference),而不是用來訓練新模型,儘管華為設計和推銷 950DT 時,主打的正是訓練這類對硬件要求更高的工作。
華為的 Ascend 950 系列分成兩款,分工明確:
型號 | 記憶體 | 頻寬 | 定位 |
|---|---|---|---|
Ascend 950PR | HiBL 1.0 | 1.6TB/s | 推理的預填充階段,成本較低 |
Ascend 950DT | HiZQ 2.0,144GB | 4TB/s | 推理的解碼階段及模型訓練 |
兩款晶片的運算核心相同,FP8 精度下均達 1 PFLOPS,分別在於記憶體。950DT 用的是華為自研的高頻寬記憶體 HiZQ 2.0,頻寬是 950PR 的 2.5 倍,這正是訓練大模型所需要的規格。DeepSeek 今年較早時推出的 V4 模型,已經在 950PR 上做推理;TrendForce 6 月報道,華為把 950DT 的上雲時間由第四季提前至 8 月,DeepSeek 被視為首批採用者之一。
至於 DeepSeek 為何不用 950DT 訓練,報道沒有解釋。可以確定的是,訓練與推理對硬件的容錯要求差距很大,而美國的出口管制令 DeepSeek 無法再大批取得 Nvidia 的訓練晶片,公司過去兩年一直靠改良算法來壓低算力需求。

時間表握在華為手上
彭博指出,16 萬顆晶片何時裝機,取決於華為的生產能力。這句話點出了整個計劃的變數:950 系列的高頻寬記憶體全部由華為自製,而分析機構 SemiAnalysis 早前已指出,中國 AI 晶片的真正瓶頸不在晶圓,而在高頻寬記憶體的供應。
對華為而言,這張訂單的意義不止於銷量。過去華為 AI 晶片的大客戶主要是國企和電訊商,DeepSeek 是中國最受國際關注的 AI 公司,它的旗艦數據中心選用 Ascend,等於替華為的晶片做了一次公開背書。對 Nvidia 而言,這則是一個明確的訊號:即使華府日後放寬對華出口,中國頭部 AI 公司已經在替自己準備另一條路。




No comments yet
提交留言即表示你已閱讀我們的私隱政策。