免費開源的 NVIDIA PAIR 測試版會尋找同一可信任區域網路中的相容裝置,並將獨立的 Ollama、LM Studio 推論請求派送至有餘裕的電腦。 PAIR 不會合併多台電腦的 VRAM、不會把模型切分到不同主機,也不會將單一推論請求拆給多張 GPU;每項請求仍須由一台裝置完整執行。
發布者使用 GPT-5.6 Terra 編輯圖片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did Nvidia announce at IFA 2026 about its local-AI strategy, including how its free open-source Personal AI Router (PAIR) pools compati. Article summary: At IFA 2026, Nvidia positioned local AI as a private, multi-device “home cluster” strategy: simplify agent setup, speed inference, and let agents use otherwise idle PCs on a local network. The central new software is PAI. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
NVIDIA 在 IFA 2026 描繪的本機 AI 策略,重點並不是再添購一套複雜的機櫃式叢集,而是讓家中同一網路裡原本就有的電腦,成為可調度的私有推論運算資源。主角是免費、開源測試版軟體 NVIDIA Personal AI Router(PAIR)。 3
8
PAIR 為 AI 應用程式與代理提供相容於 Ollama、OpenAI 的本機代理端點;它會探索區域網路中的合格電腦,並依據推論引擎、模型是否可用及當前負載,將每一個彼此獨立的推論請求路由到適當裝置。 1
7
這尤其適合會同時產生多項子任務的 AI 代理工作流程。與其讓所有任務排隊等候同一張 GPU,PAIR 可將不同的獨立請求交由不同、有空閒容量的機器處理。NVIDIA 將其定位為不必特殊線材、機櫃或複雜叢集設定的個人家庭 AI 推論叢集。 7
16
不過,使用前最該釐清的是:PAIR 並非分散式模型推論。
換句話說,PAIR 能讓多台家用電腦更有效率地並行處理代理任務,但不能藉由集合多台電腦的記憶體,讓一個任何單機都裝不下的大模型突然能跑起來。
NVIDIA 表示,PAIR 可連接同一可信任本機網路內、運行 Windows、Linux 與 macOS 的相容系統。支援範圍包括 GeForce RTX 20 系列或更新機種、採用 Turing 或更新架構的 RTX PRO 系統、DGX Spark,以及搭載 Apple M4 或更新晶片的 Mac;Windows on Arm 目前屬實驗性支援。 1
6
PAIR 可透過圖形介面或終端機操作,也支援無螢幕及 SSH 使用情境。依 NVIDIA 安裝說明,PAIR 應安裝在執行應用程式的電腦上;該電腦可把工作路由至另一台已配對裝置上的推論引擎,因此客戶端本身不一定要有 GPU 或本機推論引擎。 1
針對注重隱私的工作流程,NVIDIA 表示 PAIR 可將提示詞、檔案及代理上下文保留在家中網路內;若採完全本機設定,回應也會留在本機。實際情況仍取決於使用者選擇的模型、應用程式,以及是否啟用雲端服務。 6
7
NVIDIA 同時宣布,Hermes Agent、OpenClaw 與 Perplexity Portable Computer 將在 Windows 上提供更簡化的 NVIDIA GPU 本機模型支援。該公司稱,相關工作結合 llama.cpp 與 NVIDIA 推論最佳化,可減少挑選模型、伺服器與量化設定的手動配置。 8
Perplexity Portable Computer 已可用於配備至少 24GB VRAM NVIDIA RTX GPU 的 Linux 系統,Windows 支援則仍在規劃中。NVIDIA 表示,它可在本機執行工作流程、不需要點數,且能在使用者授權下選擇將任務升級交給超過 15 個雲端前沿模型。 8
此外,NVIDIA 宣稱新版 llama.cpp 與 vLLM 最佳化可帶來最高 1.9 倍的本機推論速度,並可直接使用,或透過 LM Studio、Ollama 取得。這是廠商所稱的最高值,實際增幅會隨模型、量化方式、GPU、記憶體容量、軟體設定與工作負載而異。 8
NVIDIA 表示,Lenovo 與 Acer 的精巧型 RTX Spark Windows 電腦預定於 2026 年 10 月推出,鎖定希望在本機安全執行 AI 代理的愛好者、開發者與創作者。 8
NVIDIA 強調這類系統最高可提供 128GB 統一記憶體,用於本機原型開發、微調及推論;同時具備 RTX 遊戲功能,包括光線追蹤、DLSS、Reflex 與 G-SYNC。該公司也點名 Electronic Arts、Embark 與 Ubisoft 為將大型遊戲帶到 RTX Spark 的開發商。 8
現有公告資料並未證實 N1X CPU、GPU 的詳細規格、Lenovo 或 Acer 的具體型號,或完整遊戲清單;這些資訊目前不宜視為已確認內容。
NVIDIA 在 RTX Spark 相關公告中列出的本機 AI 模型、工具與工作流程包括:
最貼切的理解方式,是把 PAIR 視為家庭實驗室的 AI 工作排程器,而不是把數台消費級電腦融合成一張超大 GPU 的工具。只要本機代理能把工作拆成互不依賴的請求,PAIR 就能利用閒置的相容 RTX、DGX Spark 與支援 Mac 硬體,在保有本機網路邊界的前提下提高並行處理能力。 1
6
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
免費開源的 NVIDIA PAIR 測試版會尋找同一可信任區域網路中的相容裝置,並將獨立的 Ollama、LM Studio 推論請求派送至有餘裕的電腦。
免費開源的 NVIDIA PAIR 測試版會尋找同一可信任區域網路中的相容裝置,並將獨立的 Ollama、LM Studio 推論請求派送至有餘裕的電腦。 PAIR 不會合併多台電腦的 VRAM、不會把模型切分到不同主機,也不會將單一推論請求拆給多張 GPU;每項請求仍須由一台裝置完整執行。
NVIDIA 另宣布本機代理設定簡化、llama.cpp 與 vLLM 最高 1.9 倍推論加速,以及預定 2026 年 10 月推出的精巧型 RTX Spark Windows 電腦。