FAQ su NVIDIA Personal AI Router (PAIR)

NVIDIA Personal AI Router (PAIR) è un software che collega i sistemi compatibili macOS, Windows e Linux con le GPU NVIDIA RTX™ e i sistemi DGX Spark in un cluster IA domestico personale. PAIR distribuisce i carichi di lavoro di inferenza IA locale sui dispositivi disponibili, mantenendo le istruzioni, i file e il contesto dell'agente sulla rete domestica dell'utente.

Un cluster IA domestico personale collega più dispositivi compatibili sulla stessa rete locale, consentendo loro di condividere le risorse di calcolo disponibili per l'inferenza IA locale. PAIR consente ai Mac, ai sistemi NVIDIA RTX e ai sistemi DGX Spark di fornire maggiore capacità alle applicazioni e agli agenti IA locali. I dispositivi rimangono sistemi separati che gestiscono attività parallele; PAIR non li combina in un'unica GPU virtuale.

Un nodo è un sistema compatibile abbinato a NVIDIA PAIR e reso disponibile per il cluster IA locale. I nodi possono includere Mac supportati, PC o workstation NVIDIA RTX e sistemi DGX Spark.

Sì. NVIDIA PAIR può abbinare i sistemi macOS supportati a PC, workstation e sistemi DGX Spark NVIDIA RTX compatibili sulla stessa rete locale. Questo consente agli utenti Mac di inoltrare i carichi di lavoro di inferenza IA locali alle risorse di calcolo NVIDIA disponibili.

Sì. PAIR rileva i sistemi NVIDIA RTX e DGX Spark compatibili sulla stessa rete locale e li aiuta a operare come un unico cluster di inferenza IA personale. I carichi di lavoro possono utilizzare le risorse di calcolo disponibili su più dispositivi invece di fare affidamento su una singola macchina.

Sì. NVIDIA PAIR supporta i sistemi compatibili macOS, Windows e Linux. L'hardware supportato, le versioni del sistema operativo e le configurazioni dei dispositivi possono variare, quindi controlla i requisiti di sistema attuali prima dell'installazione.

NVIDIA PAIR richiede sistemi macOS, Windows o Linux compatibili e hardware supportato. I requisiti potrebbero includere versioni specifiche del sistema operativo, GPU NVIDIA RTX, memoria della GPU, memoria di sistema, processori, storage e connettività di rete locale. Per i dettagli aggiornati, consulta la sezione Requisiti di sistema nella landing page di NVIDIA PAIR.

Sì. Puoi aggiungere un Mac supportato come nodo accanto a PC e workstation NVIDIA RTX e ai sistemi DGX Spark. PAIR coordina i dispositivi associati per i flussi di lavoro IA locali, mantenendo al contempo le istruzioni, i file e il contesto dell'agente sulla rete locale.

PAIR inoltra le richieste di inferenza ai dispositivi disponibili all'interno del cluster locale. Quando un dispositivo è occupato o raggiunge la capacità disponibile, PAIR può indirizzare le richieste ad altri nodi compatibili, contribuendo a ridurre i colli di bottiglia durante i flussi di lavoro impegnativi con IA e agenti.

Sì. PAIR supporta le applicazioni IA locali, gli agenti e i flussi di lavoro multi-agente che generano richieste di inferenza multiple o sequenziali. Instradando le richieste tra sistemi accoppiati, PAIR aiuta a rendere disponibili più risorse di calcolo locali per le attività impegnative.

Sì. PAIR supporta Ollama e LM Studio come backend di inferenza locali. Le applicazioni possono utilizzare un endpoint locale, mentre PAIR instrada le richieste di inferenza verso le risorse di calcolo disponibili all'interno del cluster IA personale.

Non sono necessarie modifiche significative alle applicazioni o agli agenti. PAIR fornisce un singolo endpoint locale e gestisce come proxy le richieste supportate di Ollama e LM Studio, riducendo la necessità di configurare le applicazioni per ogni singolo dispositivo.

PAIR è progettato per l'inferenza locale privata. I prompt, i file e il contesto dell'agente rimangono sulla rete locale dell'utente invece di essere inviati a un servizio di inferenza cloud.

No. PAIR utilizza dispositivi compatibili già connessi alla rete locale. Non richiede cavi speciali, rack per server o hardware tradizionale dei cluster dei data center.

Scarica PAIR, installalo sui sistemi supportati, associa i dispositivi sulla stessa rete locale e aggiungili al cluster. Una volta stabilita la connessione, le applicazioni e gli agenti supportati possono inviare richieste di inferenza tramite l'endpoint locale PAIR.

Scarica NVIDIA PAIR dal sito ufficiale NVIDIA PAIR. Il sito fornisce inoltre i requisiti di sistema attuali, le istruzioni per l'installazione e ulteriori FAQ.

PAIR fornisce un layer di routing di inferenza locale riutilizzabile con pairing di dispositivi, scoperta dei nodi, accesso agli endpoint, proxy di backend e routing del carico di lavoro. Uno script personalizzato in genere richiede agli sviluppatori di gestire la disponibilità dei dispositivi, gli endpoint, le porte e la configurazione delle applicazioni per ogni flusso di lavoro.