Le routeur d’IA personnel (PAIR) de NVIDIA est un logiciel qui connecte les systèmes macOS, Windows et Linux compatibles aux GPU NVIDIA RTX™ ainsi qu'aux systèmes DGX Spark afin de mettre en œuvre un cluster d’IA domestique et personnel. PAIR distribue les charges de travail pour l’inférence de l’IA locale sur les appareils disponibles tout en conservant les requêtes, les fichiers et le contexte de l’agent sur le réseau domestique de l’utilisateur.
Un cluster d’IA domestique et personnel connecte plusieurs appareils compatibles sur le même réseau local, leur permettant ainsi de partager les ressources de calcul disponibles pour l’inférence de l’IA locale. PAIR permet aux Mac, aux systèmes NVIDIA RTX et aux systèmes DGX Spark de fournir une capacité accrue aux applications et aux agents d’IA locaux. Les appareils restent des systèmes distincts qui gèrent des tâches en parallèle ; PAIR ne les combine pas en un seul GPU virtuel.
Un nœud est un système compatible qui a été associé à NVIDIA PAIR puis rendu disponible au sein du cluster d’IA local. Les nœuds peuvent inclure des Mac compatibles, des PC ou des stations de travail NVIDIA RTX ainsi que des systèmes DGX Spark.
Oui. NVIDIA PAIR peut associer des systèmes macOS pris en charge à des PC ou à des stations de travail NVIDIA RTX ainsi qu'à des systèmes DGX Spark sur le même réseau local. Cela permet aux utilisateurs Mac d’acheminer les charges de travail d’inférence d’IA en local vers les ressources de calcul de NVIDIA disponibles.
Oui. PAIR détecte les systèmes NVIDIA RTX et DGX Spark compatibles sur le même réseau local et les aide à fonctionner en tant que cluster personnel pour les inférences d’IA. Les charges de travail peuvent utiliser la puissance de calcul disponible sur plusieurs appareils au lieu de dépendre d'une seule machine.
Oui. NVIDIA PAIR prend en charge les systèmes macOS, Windows et Linux compatibles. Le matériel pris en charge, les versions du système d’exploitation et les configurations de l’appareil peuvent varier. Par conséquent, nous vous invitons à consulter la version actuelle de la configuration système requise avant toute installation.
NVIDIA PAIR nécessite des systèmes macOS, Windows ou Linux compatibles ainsi qu’un matériel pris en charge. La configuration requise peut inclure des versions spécifiques du système d’exploitation, les GPU NVIDIA RTX, la mémoire GPU, la mémoire système, les processeurs, le stockage et la connectivité au réseau local. Consultez la section relative à la configuration système requise sur la page d’accueil de NVIDIA PAIR pour en savoir plus.
Oui. Un Mac compatible peut être ajouté en tant que nœud aux côtés des PC, des stations de travail et des systèmes NVIDIA RTX et DGX Spark. PAIR coordonne les appareils associés pour les workflows d’IA locale, tout en conservant les requêtes, les fichiers et le contexte de l’agent sur le réseau local.
PAIR achemine les demandes d’inférence vers les appareils disponibles dans le cluster local. Lorsqu’un appareil est occupé ou a atteint sa capacité disponible, PAIR peut rediriger les demandes vers d’autres nœuds compatibles, ce qui contribue à réduire les goulots d’étranglement au sein des workflows d’IA et d’agents les plus exigeants.
Oui. PAIR prend en charge les applications d’IA locales, les agents et les workflows multi-agents qui génèrent des demandes d’inférence multiples ou séquentielles. En acheminant les demandes entre les systèmes jumelés, PAIR permet de fournir davantage de puissance de calcul locale pour les tâches les plus exigeantes.
Oui. PAIR prend en charge Ollama et LM Studio en tant que backends d’inférence locaux. Les applications peuvent utiliser un point de terminaison local tandis que PAIR relaie les demandes d’inférence vers la puissance de calcul disponible au sein du cluster d’IA personnel.
Aucune modification majeure n'est requise au niveau des applications ou des agents. PAIR fournit un point de terminaison local unique et relaie les demandes prises en charge par Ollama et LM Studio, réduisant ainsi la necessité de configurer les applications pour chaque appareil individuel.
PAIR est conçu pour l'inférence locale et privée. Les requêtes, les fichiers et le contexte de l’agent restent sur le réseau local de l’utilisateur au lieu d’être envoyés à un service d’inférence dans le Cloud.
Non. PAIR utilise des appareils compatibles déjà connectés au réseau local. PAIR ne nécessite pas de câbles spéciaux, de racks de serveurs ou de matériel traditionnel pour les clusters de Data Center.
Téléchargez PAIR, installez-le sur les systèmes pris en charge, associez les appareils sur le même réseau local et ajoutez-les au cluster. Une fois connectés, les applications et les agents pris en charge peuvent envoyer des demandes d’inférence via le point de terminaison local PAIR.
Téléchargez NVIDIA PAIR sur le site officiel de NVIDIA PAIR. Le site web fournit vous donne également accès à la configuration système requise actuelle, à des guides d’installation et à des FAQ supplémentaires.
PAIR fournit une couche de routage d’inférence locale réutilisable avec l’appariement des appareils, la découverte des nœuds, l’accès aux points de terminaison, le proxying en backend et le routage de la charge de travail. Un script personnalisé nécessite généralement que les développeurs gèrent la disponibilité des appareils, les points de terminaison, les ports et la configuration de l’application pour chaque workflow.