一半美國家庭有兩部電腦,NVIDIA 想把閒着那部也叫醒
NVIDIA 在 9 月 3 日的柏林 IFA 2026 上公布一批本機 AI 的軟硬件,當中最不像硬件商作風的一件,是一個免費開源工具:Personal AI Router,簡稱 PAIR。
它做的事情很直接。家中的 AI 應用只需接上同一個本機端點,PAIR 就會自動找出同一個網絡內其他合資格的電腦,再把互相獨立的推理請求分派到當刻有空的那一部。NVIDIA 自己給出的理由是超過一半美國家庭擁有兩部或以上電腦,而那些算力一整天大多閒着。
代理程式把一項複雜任務拆成多個小工作並行處理時,全部請求擠在同一張顯示卡上就會慢下來。PAIR 的用途正是把它們攤開,順帶讓主機在遊戲或剪片時,把 AI 工作推到另一部電腦上。
它只是分派工作,算力不會相加
這是官方 FAQ 裡寫得最清楚、傳媒轉述時卻最容易漏掉的一句:接上 PAIR 的機器仍然是各自獨立的系統,各自處理並行的任務,PAIR 並不會把它們合併成一張虛擬顯示卡,多張卡的算力不會相加。
換句話說,單張顯示卡放不下的模型,接多少部電腦都一樣放不下。PAIR 買到的是同時處理更多請求的能力,不是更大的模型。
PAIR 目前是 beta,支援 Windows 11、DGX OS、Ubuntu 與 macOS Tahoe,有圖形介面也有終端機版本,硬件方面認 GeForce RTX 20 系列或以上、Turing 或以上的 RTX PRO 工作站顯示卡、DGX Spark,以及 Apple M4 或更新的晶片。推理後端目前接 Ollama 與 LM Studio。
三個代理程式改成一鍵設定
要在本機跑一個代理程式,過往要自己挑模型、找相容的推理伺服器、調量化設定,還要逐個更新。NVIDIA 這次連同 Microsoft 與三個團隊,把這段功夫收成一鍵。
應用 | 開發者 | 現況 |
|---|---|---|
Hermes Agent | Nous Research | Windows 一鍵設定已推出,自動偵測顯示卡並選好模型與設定,Linux 稍後 |
OpenClaw | 開源社群 | Windows 版應用簡化本機模型設定,需要 24GB 或以上 VRAM |
Perplexity Portable Computer | Perplexity | Linux 上已可用,需 24GB 或以上 VRAM,Windows 版稍後 |
三者都建基於 llama.cpp,並已內置 NVIDIA 的推理優化。OpenClaw 這一項尤其值得留意:它是 GitHub 上最大的 AI 項目,star 數超過 38 萬。Perplexity 那一款則多了一重取捨,本機跑完整個流程不用消耗額度,需要更深的研究時才把部分任務送上雲端,而送出之前會先問准用戶。
快 1.9 倍,但比較的是自家舊版

llama.cpp 經核心重寫、改良的推測解碼與更快的 prefill,在 GeForce RTX 5090 上最多快 1.9 倍;vLLM 在 RTX PRO 6000 Blackwell 工作站版上快 1.2 倍,在兩組 DGX Spark 上最多快 1.4 倍。
值得看清楚的是圖表的兩根柱:比較基準是 NVIDIA 自己在 COMPUTEX 時的版本,不是任何對手。這是同一套軟件四個月內的自我改進,1.9 倍那一根出現在 Qwen3.6-35B 上。這些改進已經進了 llama.cpp 與 vLLM,用 LM Studio 或 Ollama 的人不用另外做甚麼。
RTX Spark 10 月開賣
同場公布的還有 RTX Spark Windows 電腦的檔期。10 月開賣,已有六家原廠在列,IFA 上 Acer 展出小型桌上機概念,Lenovo 公布 Yoga Pro 9n 與 Yoga 9n 2-in-1。
規格是一顆 1 PetaFLOP 的 RTX Blackwell 顯示核心、最多 128GB 統一記憶體,配一顆 20 核 Grace CPU。頂配版本為 6,144 個 GPU 核心加 20 核 CPU,記憶體 24GB 至 128GB;次一級為 5,120 個 GPU 核心加 18 核 CPU,記憶體 24GB 或 32GB。NVIDIA 未公布定價,摩根士丹利分析員估算頂配約 2,899 美元,次級由 1,799 美元起。
遊戲方面,Electronic Arts、Embark 與 Ubisoft 加入把作品帶上 RTX Spark 的名單,此前在 COMPUTEX 已宣布支援的還有 KRAFTON 等發行商。
一部電腦同時服侍遊戲、創作與長駐後台的代理程式,是 NVIDIA 對這台機器的說法。至於它值不值那個價,要等 10 月的實機。




No comments yet
提交留言即表示你已閱讀我們的私隱政策。