viernes, 11 de septiembre de 2026

Última hora

NVIDIA presenta PAIR, su router para repartir la IA local entre varios PCs

NVIDIA presenta PAIR, un router virtual gratuito que reparte las cargas de IA entre varios equipos de una misma red local, y anuncia mejoras de rendimiento y nuevos modelos.

Teknologiko
Teknologiko
· 3 min de lectura

NVIDIA ha presentado en IFA 2026 una batería de novedades para la IA local, entre ellas PAIR, una herramienta que distribuye las cargas de inferencia entre varios equipos de una misma red.

NVIDIA ha aprovechado la feria IFA 2026 para presentar un conjunto de novedades orientadas a acelerar la inteligencia artificial local. Entre ellas destaca NVIDIA Personal AI Router, o PAIR, una herramienta gratuita y de código abierto que permite repartir las solicitudes de inferencia entre varios equipos compatibles de una misma red local, según publica MuyComputer.

PAIR funciona como un router virtual que descubre los sistemas disponibles, comprueba qué modelos tienen cargados y qué capacidad libre ofrecen, y decide dónde ejecutar cada trabajo. No sustituye a Ollama o LM Studio ni introduce un nuevo motor: desde el punto de vista del agente sigue existiendo una única conexión, mientras PAIR se encarga de toda la distribución por detrás.

La herramienta está pensada para agentes compuestos por múltiples subagentes, que dividen una tarea compleja en muchos trabajos independientes. PAIR puede enviar unas peticiones al PC principal y otras a equipos adicionales de la red que tengan recursos disponibles, reduciendo las colas y permitiendo ejecutar más trabajos simultáneamente. No fusiona varias GPUs ni suma su VRAM: cada solicitud se ejecuta completa en un solo nodo.

La beta de PAIR es compatible con Windows, macOS y Linux, con GeForce RTX 20 Series y posteriores, RTX PRO basadas en Turing o arquitecturas más recientes, DGX Spark y sistemas Apple con chips M4 o posteriores. Un portátil puede suspenderse, un PC puede empezar a utilizar intensamente su GPU y otro equipo puede incorporarse o desaparecer de la red sin romper el conjunto. Las conexiones se establecen mediante emparejamiento seguro, mTLS y certificados generados para mantener las comunicaciones dentro de la red privada.

En una demostración con Hermes y Qwen3.6 35B A3B, una tarea repartida entre cinco subagentes tardó una media de 6 minutos y 18 segundos con una sola RTX 5090. Al repetir el trabajo con un clúster PAIR formado por dos RTX 5090, el tiempo bajó hasta 3 minutos y 48 segundos. NVIDIA advierte de que se trata de una demostración concreta y no de un benchmark general.

Junto a PAIR, la compañía ha anunciado mejoras de rendimiento en llama.cpp y vLLM, y la llegada este mes de Perplexity Portable Computer a GPUs RTX con al menos 24 GB de VRAM. También ha confirmado que los primeros PC Windows basados en RTX Spark llegarán en octubre.

Teknologiko

Escrito por

Teknologiko

Si algo está mal, lo digo; si está bien, también.