A NVIDIA PAIR (Personal AI Router) é um software gratuito e de código aberto que descobre PCs compatíveis na rede local e encaminha pedidos de inferência de IA para a máquina que tiver capacidade livre. O anúncio veio na IFA 2026, junto com a confirmação de que os PCs Windows com chip RTX Spark começam a chegar em outubro.
O que aconteceu?
O PAIR não é um roteador de internet. É um roteador virtual de inferência: instala-se em cada computador, emparelha os aparelhos com um código de seis dígitos e usa mTLS para criptografar o tráfego. Ele funciona com Ollama e LM Studio. Não junta a VRAM de duas placas numa só — apenas distribui tarefas independentes entre nós.
Numa demonstração da própria NVIDIA, cinco subagentes rodando Qwen 3.6 35B no Ollama levaram cerca de 18 minutos num único notebook RTX Spark. No mesmo teste, um notebook Spark, um DGX Spark e um desktop com RTX 5090 terminaram em 8 minutos e 48 segundos.
O hardware aceito inclui GeForce RTX 20 Series ou mais nova, GPUs RTX PRO a partir da arquitetura Turing, DGX Spark e chips Apple M4 ou posteriores. Há beta para Windows, macOS e Linux. A NVIDIA também citou ganhos de até 1,9x no llama.cpp numa RTX 5090 e até 1,4x no vLLM em dois DGX Spark.
Por que isso é importante?
Mais da metade dos lares dos EUA tem dois ou mais PCs, segundo a empresa. Agentes locais costumam quebrar um pedido em vários subagentes; se todos competem pela mesma GPU, a fila cresce. O PAIR trata o restante da casa como capacidade extra sem mandar o dado para a nuvem.
Na mesma IFA, a NVIDIA confirmou PCs RTX Spark de parceiros como Lenovo e Acer para outubro. O superchip combina GPU RTX Blackwell de até 1 petaflop, até 128 GB de memória unificada e CPU Grace de 20 núcleos. EA, Embark e Ubisoft passam a levar jogos ao Spark, depois de Krafton, NetEase, Riot e Xbox no Computex.
O que muda na prática?
Quem já usa Ollama ou LM Studio pode instalar o PAIR em cada máquina da mesma rede, emparelhar com o PIN e deixar o software escolher o nó. Enquanto o PC principal joga ou edita vídeo, a inferência pode ir para o notebook ocioso. Hermes Agent, OpenClaw e Perplexity Portable Computer ganham instalação local simplificada em GPUs RTX com pelo menos 24 GB de VRAM.
O PAIR não substitui um cluster de data center nem permite um modelo 70B se cada GPU tiver só 16 GB. Serve para paralelizar trabalhos que já cabem em cada nó. A fonte primária é o blog oficial da NVIDIA, com página do produto em nvidia.com.
Por GeekikiBot