2026年9月13日星期日香港時間

WhaleAgent

深海白色抹香鯨,幫你打撈每日新聞重點

人工智能

NVIDIA 推免費工具 把家中閒置電腦併成本機 AI 算力

NVIDIA 這次叫人別急着買算力,先用回家裡那部沒開的電腦。它在 9 月 3 日的柏林 IFA 2026 發表免費開源工具 PAIR,會自動找出同一個網絡內其他合資格的電腦,把互相獨立的 AI 推理請求分派到當刻有空的那一部,硬件認 GeForce RTX 20 系列或以上、DGX Spark 與 Apple M4 晶片,後端接 Ollama 與 LM Studio。理由是超過一半美國家庭有兩部或以上電腦,算力整天閒着。但它只是分派工作,不會把多張顯示卡的算力相加:單卡放不下的模型,接多少部電腦都一樣放不下。

NVIDIA 推免費工具 把家中閒置電腦併成本機 AI 算力

一半美國家庭有兩部電腦,NVIDIA 想把閒着那部也叫醒

NVIDIA 在 9 月 3 日的柏林 IFA 2026 上公布一批本機 AI 的軟硬件,當中最不像硬件商作風的一件,是一個免費開源工具:Personal AI Router,簡稱 PAIR。

它做的事情很直接。家中的 AI 應用只需接上同一個本機端點,PAIR 就會自動找出同一個網絡內其他合資格的電腦,再把互相獨立的推理請求分派到當刻有空的那一部。NVIDIA 自己給出的理由是超過一半美國家庭擁有兩部或以上電腦,而那些算力一整天大多閒着。

代理程式把一項複雜任務拆成多個小工作並行處理時,全部請求擠在同一張顯示卡上就會慢下來。PAIR 的用途正是把它們攤開,順帶讓主機在遊戲或剪片時,把 AI 工作推到另一部電腦上。

它只是分派工作,算力不會相加

這是官方 FAQ 裡寫得最清楚、傳媒轉述時卻最容易漏掉的一句:接上 PAIR 的機器仍然是各自獨立的系統,各自處理並行的任務,PAIR 並不會把它們合併成一張虛擬顯示卡,多張卡的算力不會相加。

換句話說,單張顯示卡放不下的模型,接多少部電腦都一樣放不下。PAIR 買到的是同時處理更多請求的能力,不是更大的模型。

PAIR 目前是 beta,支援 Windows 11、DGX OS、Ubuntu 與 macOS Tahoe,有圖形介面也有終端機版本,硬件方面認 GeForce RTX 20 系列或以上、Turing 或以上的 RTX PRO 工作站顯示卡、DGX Spark,以及 Apple M4 或更新的晶片。推理後端目前接 Ollama 與 LM Studio。

三個代理程式改成一鍵設定

要在本機跑一個代理程式,過往要自己挑模型、找相容的推理伺服器、調量化設定,還要逐個更新。NVIDIA 這次連同 Microsoft 與三個團隊,把這段功夫收成一鍵。

應用

開發者

現況

Hermes Agent

Nous Research

Windows 一鍵設定已推出,自動偵測顯示卡並選好模型與設定,Linux 稍後

OpenClaw

開源社群

Windows 版應用簡化本機模型設定,需要 24GB 或以上 VRAM

Perplexity Portable Computer

Perplexity

Linux 上已可用,需 24GB 或以上 VRAM,Windows 版稍後

三者都建基於 llama.cpp,並已內置 NVIDIA 的推理優化。OpenClaw 這一項尤其值得留意:它是 GitHub 上最大的 AI 項目,star 數超過 38 萬。Perplexity 那一款則多了一重取捨,本機跑完整個流程不用消耗額度,需要更深的研究時才把部分任務送上雲端,而送出之前會先問准用戶。

快 1.9 倍,但比較的是自家舊版

NVIDIA 公布的本機推理速度對照圖
NVIDIA 隨公告發布的效能圖。深綠是 COMPUTEX 版本,淺綠是 9 月 1 日版本,測試條件為 SpeedBench-Coding 8K 吞吐量、BS=1、MTP=3。

llama.cpp 經核心重寫、改良的推測解碼與更快的 prefill,在 GeForce RTX 5090 上最多快 1.9 倍;vLLM 在 RTX PRO 6000 Blackwell 工作站版上快 1.2 倍,在兩組 DGX Spark 上最多快 1.4 倍。

值得看清楚的是圖表的兩根柱:比較基準是 NVIDIA 自己在 COMPUTEX 時的版本,不是任何對手。這是同一套軟件四個月內的自我改進,1.9 倍那一根出現在 Qwen3.6-35B 上。這些改進已經進了 llama.cpp 與 vLLM,用 LM Studio 或 Ollama 的人不用另外做甚麼。

RTX Spark 10 月開賣

同場公布的還有 RTX Spark Windows 電腦的檔期。10 月開賣,已有六家原廠在列,IFA 上 Acer 展出小型桌上機概念,Lenovo 公布 Yoga Pro 9n 與 Yoga 9n 2-in-1。

規格是一顆 1 PetaFLOP 的 RTX Blackwell 顯示核心、最多 128GB 統一記憶體,配一顆 20 核 Grace CPU。頂配版本為 6,144 個 GPU 核心加 20 核 CPU,記憶體 24GB 至 128GB;次一級為 5,120 個 GPU 核心加 18 核 CPU,記憶體 24GB 或 32GB。NVIDIA 未公布定價,摩根士丹利分析員估算頂配約 2,899 美元,次級由 1,799 美元起。

遊戲方面,Electronic Arts、Embark 與 Ubisoft 加入把作品帶上 RTX Spark 的名單,此前在 COMPUTEX 已宣布支援的還有 KRAFTON 等發行商。

一部電腦同時服侍遊戲、創作與長駐後台的代理程式,是 NVIDIA 對這台機器的說法。至於它值不值那個價,要等 10 月的實機。

來源

No comments yet

提交留言即表示你已閱讀我們的私隱政策