O NVIDIA Personal AI Router (PAIR) é um software que conecta sistemas macOS, Windows e Linux compatíveis com GPUs NVIDIA RTX e sistemas DGX Spark em um cluster de IA pessoal doméstico. O PAIR distribui cargas de trabalho de inferência de IA locais entre os dispositivos disponíveis, mantendo prompts, arquivos e contexto de agentes na rede doméstica do usuário.
Um cluster de IA pessoal doméstico conecta vários dispositivos compatíveis na mesma rede local, permitindo que eles compartilhem recursos de computação disponíveis para inferência de IA local. O PAIR permite que Macs, sistemas NVIDIA RTX e sistemas DGX Spark ofereçam mais capacidade para aplicativos e agentes de IA locais. Os dispositivos permanecem sistemas separados que lidam com tarefas paralelas; o PAIR não os combina em uma GPU virtual.
Um nó é um sistema compatível que foi pareado com o NVIDIA PAIR e disponibilizado para o cluster de IA local. Os nós podem incluir Macs compatíveis, PCs ou workstations NVIDIA RTX e sistemas DGX Spark.
Sim. O NVIDIA PAIR pode parear sistemas macOS compatíveis com PCs e workstations NVIDIA RTX e sistemas DGX Spark compatíveis na mesma rede local. Isso permite que usuários de Mac encaminhem cargas de trabalho de inferência de IA local para os recursos de computação NVIDIA disponíveis.
Sim. O PAIR descobre sistemas compatíveis com NVIDIA RTX e DGX Spark na mesma rede local e os ajuda a operar como um cluster de inferência de IA pessoal. As cargas de trabalho podem usar a computação disponível em vários dispositivos, em vez de depender de uma única máquina.
Sim. O NVIDIA PAIR é compativel com sistemas macOS, Windows e Linux compatíveis. O hardware compatível, as versões do sistema operacional e as configurações dos dispositivos podem variar. Portanto, consulte os requisitos de sistema atuais antes da instalação.
O NVIDIA PAIR requer sistemas macOS, Windows ou Linux compatíveis e hardware compatível. Os requisitos podem incluir versões específicas do sistema operacional, GPUs NVIDIA RTX, memória da GPU, memória do sistema, processadores, armazenamento e conectividade de rede local. Consulte a seção de Requisitos do Sistema na página inicial do NVIDIA PAIR para obter detalhes atuais.
Sim. Um Mac compatível pode ser adicionado como um nó juntamente com PCs e workstations NVIDIA RTX e sistemas DGX Spark. O PAIR coordena os dispositivos pareados para fluxos de trabalho de IA locais, mantendo prompts, arquivos e contexto de agentes na rede local.
O PAIR roteia solicitações de inferência para dispositivos disponíveis no cluster local. Quando um dispositivo está ocupado ou atinge sua capacidade disponível, o PAIR pode direcionar as solicitações para outros nós compatíveis, ajudando a reduzir gargalos durante fluxos de trabalho exigentes de IA e baseados em agentes.
Sim. O PAIR é compatível com aplicativos de IA locais, agentes e fluxos de trabalho de vários agentes que geram solicitações de inferência múltiplas ou sequenciais. Ao rotear solicitações entre sistemas pareados, o PAIR ajuda a disponibilizar mais recursos de computação local para tarefas exigentes.
Sim. O PAIR é compatível com o Ollama e o LM Studio como backends de inferência locais. Os aplicativos podem usar um endpoint local, enquanto o PAIR atua como proxy de solicitações de inferência para os recursos de computação disponíveis no cluster de IA pessoal.
Não são necessárias alterações importantes no aplicativo ou no agente. O PAIR fornece um único endpoint local e atua como proxy de solicitações compatíveis do Ollama e LM Studio, reduzindo a necessidade de configurar aplicativos para cada dispositivo individual.
O PAIR foi projetado para inferência local privada. Os prompts, arquivos e contexto dos agentes permanecem na rede local do usuário, em vez de serem enviados para um serviço de inferência na nuvem.
Não. O PAIR usa dispositivos compatíveis já conectados à rede local. Ele não requer cabos especiais, racks de servidores ou hardware tradicional de cluster de data center.
Faça o download do PAIR, instale-o em sistemas compatíveis, pareie os dispositivos na mesma rede local e adicione-os ao cluster. Uma vez conectados, os aplicativos e agentes compatíveis podem enviar solicitações de inferência por meio do endpoint local do PAIR.
Faça o download do NVIDIA PAIR no site oficial do NVIDIA PAIR. O site também fornece informações sobre requisitos atuais do sistema, orientações de instalação e perguntas frequentes adicionais.
O PAIR fornece uma camada de roteamento de inferência local reutilizável com pareamento de dispositivos, descoberta de nós, acesso a endpoints, proxy de backend e roteamento de carga de trabalho. Um script personalizado normalmente exige que os desenvolvedores gerenciem a disponibilidade de dispositivos, endpoints, portas e configuração de aplicativos para cada workflow.