La versione beta di NVIDIA PAIR collega i flussi di lavoro di app IA e agenti a un singolo endpoint locale per l'instradamento dell'inferenza su NVIDIA DGX Spark™, sistemi Windows con RTX™ e dispositivi macOS. Questo ti aiuta a massimizzare le risorse di calcolo locali, mantenendo riservate le istruzioni, i file e il contesto dell'agente.
Caratteristiche
Riunisci i sistemi RTX, DGX™ e Mac già presenti sulla tua rete in pochi minuti. NVIDIA PAIR rileva le macchine locali compatibili e le aiuta a lavorare come un unico cluster di inferenza IA personale senza dover utilizzare cavi speciali, rack o configurazioni di cluster complesse.
Mantieni i flussi di lavoro IA locali in movimento quando le attività si accumulano. NVIDIA PAIR instrada le richieste di inferenza IA tra i nodi locali disponibili, aiutando i flussi di lavoro IA intensivi ad accedere alle risorse di calcolo inattive indipendentemente dal sistema operativo del nodo.
Esegui NVIDIA PAIR accanto ai backend di inferenza locali su Windows, Linux e macOS. Al lancio, NVIDIA PAIR supporta Ollama e LM Studio, offrendo alle app un endpoint singolo coerente, instradando in modo intelligente le richieste alle risorse di calcolo locali disponibili.
Esegui i flussi di lavoro IA a casa con i dati che rimangono sulla tua rete. NVIDIA PAIR è progettato per l'inferenza locale privata, aiutandoti a utilizzare le istruzioni, i file e il contesto degli agenti senza inviarli al cloud.
NVIDIA PAIR funziona senza cavi o rack speciali. La configurazione è semplice.
2
3
Piattaforma
Windows 11, DGX OS, Ubuntu 14.04, macOS Tahoe
Lingua
Inglese
GPU
Tutte le GPU GeForce RTX (Serie 20 e versioni successive), DGX Spark/GB10, Mac M4 o versioni successive
RAM
8 GB di RAM o superiore
Spazio su disco
Consigliato: 20 GB o superiore
Internet
Non richiesto per il funzionamento
Richiesto per il download dei modelli
NVIDIA Personal AI Router (PAIR) è un software che collega i sistemi compatibili macOS, Windows e Linux con le GPU NVIDIA RTX™ e i sistemi DGX Spark in un cluster IA domestico personale. PAIR distribuisce i carichi di lavoro di inferenza IA locale sui dispositivi disponibili, mantenendo le istruzioni, i file e il contesto dell'agente sulla rete domestica dell'utente.
Un cluster IA domestico personale collega più dispositivi compatibili sulla stessa rete locale, consentendo loro di condividere le risorse di calcolo disponibili per l'inferenza IA locale. PAIR consente ai Mac, ai sistemi NVIDIA RTX e ai sistemi DGX Spark di fornire maggiore capacità alle applicazioni e agli agenti IA locali. I dispositivi rimangono sistemi separati che gestiscono attività parallele; PAIR non li combina in un'unica GPU virtuale.
Scarica PAIR, installalo sui sistemi supportati, associa i dispositivi sulla stessa rete locale e aggiungili al cluster. Una volta stabilita la connessione, le applicazioni e gli agenti supportati possono inviare richieste di inferenza tramite l'endpoint locale PAIR.
NVIDIA PAIR richiede sistemi macOS, Windows o Linux compatibili e hardware supportato. I requisiti potrebbero includere versioni specifiche del sistema operativo, GPU NVIDIA RTX, memoria della GPU, memoria di sistema, processori, storage e connettività di rete locale. Per i dettagli aggiornati, consulta la sezione Requisiti di sistema nella landing page di NVIDIA PAIR.
PAIR è progettato per l'inferenza locale privata. I prompt, i file e il contesto dell'agente rimangono sulla rete locale dell'utente invece di essere inviati a un servizio di inferenza cloud.