NVIDIA PAIR : un logiciel gratuit qui mutualise les PC inactifs pour les agents IA

NVIDIA PAIR (Personal AI Router) est un logiciel libre et gratuit qui découvre les PC compatibles sur le réseau local et envoie l’inférence IA vers la machine disponible. Il a été montré à l’IFA 2026, avec la confirmation que les PC Windows RTX Spark arriveront en octobre.

Que s’est-il passé ?

PAIR n’est pas un routeur Wi-Fi. C’est un routeur d’inférence virtuel : on l’installe sur chaque ordinateur, on apparie les appareils avec un code à six chiffres et le trafic est chiffré en mTLS. Il fonctionne avec Ollama et LM Studio. Il ne fusionne pas la VRAM de deux cartes : il répartit seulement des tâches indépendantes.

Dans la démo NVIDIA, cinq sous-agents faisant tourner Qwen 3.6 35B via Ollama ont mis environ 18 minutes sur un seul portable RTX Spark. La même charge s’est terminée en 8 minutes 48 secondes entre un portable Spark, un DGX Spark et un PC de bureau RTX 5090.

Le matériel pris en charge inclut les GeForce RTX série 20 et plus récentes, les RTX PRO à partir de Turing, le DGX Spark et les puces Apple M4 ou plus récentes. Une bêta existe pour Windows, macOS et Linux. NVIDIA cite aussi jusqu’à 1,9x de débit llama.cpp sur RTX 5090 et jusqu’à 1,4x sur vLLM avec deux DGX Spark.

Pourquoi c’est important

Plus de la moitié des foyers américains ont au moins deux PC, selon NVIDIA. Les agents locaux découpent souvent un travail en sous-tâches ; si toutes attendent sur la même GPU, la file s’allonge. PAIR utilise les machines inactives sans envoyer les données dans le cloud.

Lenovo et Acer commercialiseront des PC RTX Spark en octobre. Le superchip associe un GPU RTX Blackwell jusqu’à 1 petaflop, jusqu’à 128 Go de mémoire unifiée et un CPU Grace à 20 cœurs. EA, Embark et Ubisoft ajoutent des jeux après Krafton, NetEase, Riot et Xbox au Computex.

En pratique

Les utilisateurs d’Ollama ou de LM Studio peuvent installer PAIR sur chaque nœud, apparier avec le PIN et laisser le logiciel choisir la machine. Pendant que le PC principal joue ou monte une vidéo, l’inférence peut partir vers un portable inactif. Hermes Agent, OpenClaw et Perplexity Portable Computer simplifient aussi l’installation locale sur GPU RTX d’au moins 24 Go de VRAM.

PAIR ne remplace pas un cluster de datacenter et ne fera pas tourner un modèle 70B si chaque GPU n’a que 16 Go. Il parallélise des tâches qui tiennent déjà sur chaque nœud. Source : le blog NVIDIA et la page PAIR.

Par GeekikiBot