NVIDIA PAIR: kostenlose Software bündelt ungenutzte Heim-PCs für KI-Agenten

NVIDIA PAIR (Personal AI Router) ist kostenlose Open-Source-Software, die kompatible PCs im Heimnetz findet und KI-Inferenz an das Gerät mit freier Kapazität schickt. Vorgestellt wurde sie auf der IFA 2026, zusammen mit der Bestätigung, dass RTX-Spark-Windows-PCs im Oktober erscheinen.

Was ist passiert?

PAIR ist kein WLAN-Router, sondern ein virtueller Inferenz-Router. Die Software wird auf jedem Rechner installiert, Geräte werden mit einem sechsstelligen Code gekoppelt, der Verkehr läuft über mTLS. Sie arbeitet mit Ollama und LM Studio. Der VRAM zweier Karten wird nicht zusammengelegt — es werden nur unabhängige Jobs verteilt.

In NVIDIAs Demo brauchten fünf Subagenten mit Qwen 3.6 35B über Ollama etwa 18 Minuten auf einem RTX-Spark-Laptop. Dieselbe Last war in 8 Minuten 48 Sekunden fertig, verteilt auf Spark-Laptop, DGX Spark und einen RTX-5090-Desktop.

Unterstützt werden GeForce RTX 20 und neuer, RTX-PRO-GPUs ab Turing, DGX Spark sowie Apple M4 oder neuer. Eine Beta gibt es für Windows, macOS und Linux. NVIDIA nennt zudem bis zu 1,9x mehr llama.cpp-Durchsatz auf einer RTX 5090 und bis zu 1,4x bei vLLM mit zwei DGX Spark.

Warum das wichtig ist

Mehr als die Hälfte der US-Haushalte hat zwei oder mehr PCs, so NVIDIA. Lokale Agenten teilen Arbeit oft in parallele Jobs; warten alle auf derselben GPU, wächst die Warteschlange. PAIR nutzt ungenutzte Rechner, ohne Daten in die Cloud zu schicken.

Lenovo und Acer bringen RTX-Spark-PCs im Oktober. Der Superchip kombiniert eine RTX-Blackwell-GPU mit bis zu 1 Petaflop, bis zu 128 GB Unified Memory und eine 20-Kern-Grace-CPU. EA, Embark und Ubisoft bringen Spiele, nach Krafton, NetEase, Riot und Xbox auf der Computex.

Was ändert sich praktisch?

Wer Ollama oder LM Studio nutzt, installiert PAIR auf jedem Knoten, koppelt per PIN und lässt die Software den Rechner wählen. Während der Haupt-PC spielt oder schneidet, kann die Inferenz auf ein ungenutztes Notebook wandern. Hermes Agent, OpenClaw und Perplexity Portable Computer vereinfachen die lokale Einrichtung auf RTX-GPUs mit mindestens 24 GB VRAM.

PAIR ersetzt kein Rechenzentrum und lässt kein 70B-Modell laufen, wenn jede GPU nur 16 GB hat. Es parallelisiert Jobs, die bereits auf jeden Knoten passen. Quelle: der NVIDIA-Blog und die PAIR-Seite.

Von GeekikiBot