La version beta de NVIDIA PAIR connecte les workflows des applications d’IA et des agents à un point de terminaison local unique pour le routage de l’inférence sur NVIDIA DGX Spark™, les systèmes Windows avec RTX™ et les appareils macOS. Cela vous permet de maximiser la puissance de calcul locale tout en préservant la confidentialité des requêtes, des fichiers et du contexte de l’agent.
Caractéristiques
Regrouper les systèmes RTX, DGX™ et Mac déjà présents sur votre réseau en quelques minutes. NVIDIA PAIR détecte les machines locales compatibles et les aide à fonctionner en tant que cluster personnel pour les inférences d’IA, sans câbles spéciaux, ni racks ni configuration de clusters complexes.
Conserver le mouvement des workflows d’IA locaux lorsque les tâches s’accumulent. NVIDIA PAIR achemine les demandes d’inférence d’IA entre les nœuds locaux disponibles, permettant ainsi aux workflows d’IA occupés à tirer parti de la puissance de calcul au repos, quel que soit le système d’exploitation du nœud.
Exécutez NVIDIA PAIR aux côtés de backends d’inférence locaux familiers sur Windows, Linux et macOS. Dès son lancement, NVIDIA PAIR prendra en charge Ollama et LM Studio, offrant ainsi aux applications un point de terminaison unique et cohérent tout en adressant intelligemment les demandes par proxy à la puissance de calcul locale disponible.
Exécutez des workflows d’IA chez vous avec des données restant sur votre réseau. NVIDIA PAIR est conçu pour l’inférence locale et privée, vous permettant d’utiliser les requêtes, les fichiers et le contexte de l’agent sans les envoyer dans le Cloud.
NVIDIA PAIR fonctionne sans câbles ni racks spéciaux. Et sa configuration est très simple.
2
3
Plateforme
Windows 11, DGX OS, Ubuntu 14.04, macOS Tahoe
Langue
Français
GPU
Tous les GPU GeForce RTX (série 20 et ultérieurs), DGX Spark/GB10, Mac M4 ou ultérieur
RAM
8 Go de RAM ou plus
Espace disque
Recommandé : 20 Go ou plus
Internet
Non requis pour le fonctionnement
Requis pour le téléchargement du modèle
Le routeur d’IA personnel (PAIR) de NVIDIA est un logiciel qui connecte les systèmes macOS, Windows et Linux compatibles aux GPU NVIDIA RTX™ et aux systèmes DGX Spark afin de mettre en œuvre un cluster d’IA domestique et personnel. PAIR distribue les charges de travail pour l’inférence de l’IA locale sur les appareils disponibles tout en conservant les requêtes, les fichiers et le contexte de l’agent sur le réseau domestique de l’utilisateur.
Un cluster d’IA domestique et personnel connecte plusieurs appareils compatibles sur le même réseau local, leur permettant ainsi de partager les ressources de calcul disponibles pour l’inférence de l’IA locale. PAIR permet aux Mac, aux systèmes NVIDIA RTX et aux systèmes DGX Spark de fournir une capacité accrue aux applications et aux agents d’IA locaux. Les appareils restent des systèmes distincts qui gèrent des tâches en parallèle ; PAIR ne les combine pas en un seul GPU virtuel.
Téléchargez PAIR, installez-le sur les systèmes pris en charge, associez les appareils sur le même réseau local et ajoutez-les au cluster. Une fois connectés, les applications et les agents pris en charge peuvent envoyer des demandes d’inférence via le point de terminaison local PAIR.
NVIDIA PAIR nécessite des systèmes macOS, Windows ou Linux compatibles ainsi qu’un matériel pris en charge. La configuration requise peut inclure des versions spécifiques du système d’exploitation, les GPU NVIDIA RTX, la mémoire GPU, la mémoire système, les processeurs, le stockage et la connectivité au réseau local. Consultez la section relative à la configuration système requise sur la page d’accueil de NVIDIA PAIR pour en savoir plus.
PAIR est conçu pour l'inférence locale et privée. Les requêtes, les fichiers et le contexte de l’agent restent sur le réseau local de l’utilisateur au lieu d’être envoyés à un service d’inférence dans le Cloud.