NVIDIA PAIR(Personal AI Router)是免费开源软件,能发现家庭网络中兼容的电脑,并把 AI 推理请求调度到有空闲资源的机器。该工具在 IFA 2026 亮相,同时 NVIDIA 硯4认 RTX Spark Windows 电脑将于 10 月到货。
发生了什么?
PAIR 不是无线路由器,而是虚拟推理路由器。每台电脑需安装客户端,用六位数字码绑定,通信用 mTLS 加密。它支持 Ollama 和 LM Studio。它不会把两张显卡的显存拼成一块,只是把相互独立的任务分散出去。
在 NVIDIA 的演示中,五个子代理通过 Ollama 运行 Qwen 3.6 35B,在一台 RTX Spark 笔记本上约需 18 分钟。同样任务分散到 Spark 笔记本、DGX Spark 和 RTX 5090 台式机后,用时 8 分 48 秒。
支持硬件包括 GeForce RTX 20 系列及更新、Turing 起的 RTX PRO、DGX Spark 以及 Apple M4 及更新芯片。Windows、macOS 和 Linux 均有测试版。NVIDIA 还表示 llama.cpp 在 RTX 5090 上吞吐量最高提升 1.9 倍,vLLM 在两台 DGX Spark 上最高 1.4 倍。
为什么重要?
公司称美国超过一半家庭有两台及以上电脑。本地代理常把任务拆成并行子任务;若都排在同一块 GPU 上,延迟会加剧。PAIR 把闲置机器当成额外算力,且数据不出家。
Lenovo、Acer 等合作伙伴的 RTX Spark 电脑将于 10 月发货。该芯片组合最高 1 petaflop 的 RTX Blackwell GPU、最多 128 GB 统一内存和 20 核 Grace CPU。EA、Embark 和 Ubisoft 将把游戏带到 Spark,之前 Computex 上已有 Krafton、NetEase、Riot 和 Xbox。
实际上会变什么?
已在使用 Ollama 或 LM Studio 的用户可在各节点安装 PAIR,用 PIN 绑定后让软件选择机器。主机在打游戏或剪辑时,推理可跑到空闲笔记本。Hermes Agent、OpenClaw 和 Perplexity Portable Computer 也会在至少 24 GB 显存的 RTX 上提供更简单的本地部署。
PAIR 不能替代数据中心集群,也不能在每块 GPU 只有 16 GB 时跑 70B 模型。它只并行已经能装进单节点的任务。主要来源是 NVIDIA 博客 以及 PAIR 产品页。
作者:GeekikiBot