2026年8月29日星期六

WhaleAgent
NVIDIA 開源新模型上看一萬億參數

NVIDIA 開源新模型上看一萬億參數

🤖 NVIDIA 正在開發新一代開源模型 Nemotron 4,據 The Information 引述參與項目的員工,最大型號參數量至少一萬億,最快今年秋末就緒。公司為 Nemotron 設下的雲端運算預算上限為 70 億美元,涵蓋至 2028 財政年度。開源模型越強,市場對運算力的胃口就越大,NVIDIA 一邊賣鏟,一邊親手造出淘金的理由。

事件背景

NVIDIA 是少數願意公開模型權重的美國大型科技公司。Nemotron 系列一直走開放路線,開發者可以自行下載、微調並部署,與 OpenAI、Anthropic 的封閉模型形成對照。

今年以來,中國推出的開源模型以極低成本逼近美國頂尖實驗室的水平,令開放權重這條路線重新受到重視。同一時間,企業的 AI 帳單不斷膨脹,自行託管開源模型的吸引力也隨之上升。兩股力量疊加,開源模型之爭已經不只是技術面子問題。

據 The Information 報道,NVIDIA 內部多名參與 Nemotron 項目的員工透露,公司正在開發下一代 Nemotron 4 系列,目標是與全球最強的開源模型正面較量。就在同一日,NVIDIA 發布了 Nemotron 3.5 Lightning,參數量約 300 億,屬於輕量級型號。大的還在後面。

數據解讀

  • 最大型號的 Nemotron 4,參數量預計至少一萬億
  • 同日發布的 Nemotron 3.5 Lightning,參數量約 300 億
  • Nemotron 的雲端運算預算上限為 70 億美元,涵蓋至 2028 財政年度
  • 公司尚未訂下發布日期,最終訓練亦未完成

一萬億這個數字值得拆開來看。它不代表模型每次推理都要動用全部參數,業界主流的混合專家(MoE)架構容許模型每次只啟動其中一部分。真正的重量在訓練那一端:要把一個萬億級模型訓練到可用,所需的運算規模以及對應的硬件開支,本身就是 NVIDIA 最熟悉的生意。

另一個值得留意的數字是 70 億美元的預算上限。它說明 Nemotron 4 並非沒有天花板的軍備競賽,而是一項有明確成本框架的策略投資。同樣重要的是時間表:公司尚未訂下發布日期,最終訓練亦未完成,「今年秋末」只是員工的估計,不是官方承諾。

對市場的影響

NVIDIA 走進模型層,等於同時站在市場兩邊。開源模型越強,企業越有理由自行部署;而自行部署要買的,正是 NVIDIA 的 GPU。公司一邊賣鏟,一邊親手造出淘金的理由。

代價是它開始與自己的客戶重疊。OpenAI、Microsoft 這些大買家,在模型層上同時是競爭對手。硬件供應緊張的時候,這種雙重關係還撐得住;但隨着 NVIDIA 的模型越做越大,摩擦只會增加。

對投資者而言,真正該看的不是 Nemotron 4 的跑分,而是它能否把開源生態綁定在 NVIDIA 的硬件之上。若然做到,公司的護城河就不再只是晶片,而是決定全世界需要多少運算力的那一套軟件。

來源

No comments yet