Skip to main content
NVIDIA mette a disposizione gratuitamente modelli aperti tramite un’API compatibile con OpenAI all’indirizzo https://integrate.api.nvidia.com/v1, autenticata con una chiave API ottenuta da build.nvidia.com. OpenClaw imposta per impostazione predefinita il provider NVIDIA su Nemotron 3 Ultra, il modello di ragionamento NVIDIA con 550 miliardi di parametri totali e 55 miliardi attivi, progettato per attività agentiche con contesti estesi.

Guida introduttiva

1

Ottieni la chiave API

Crea una chiave API su build.nvidia.com.
2

Esporta la chiave ed esegui la configurazione iniziale

3

Imposta un modello NVIDIA

Per la configurazione non interattiva, passa direttamente la chiave:
--nvidia-api-key inserisce la chiave nella cronologia della shell e nell’output di ps. Quando possibile, preferisci la variabile d’ambiente NVIDIA_API_KEY.

Esempio di configurazione

Catalogo in evidenza

Quando è configurata una chiave API NVIDIA, i percorsi di configurazione e selezione del modello recuperano il catalogo pubblico dei modelli in evidenza di NVIDIA da https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json e memorizzano il risultato nella cache per 24 ore (le prime 32 voci, importate come righe con input di testo gratuito). I nuovi modelli in evidenza di build.nvidia.com vengono quindi visualizzati nelle interfacce di configurazione e selezione del modello senza attendere una versione di OpenClaw. Quando il feed in tempo reale è disponibile, il primo modello restituito è l’opzione preselezionata durante la configurazione di NVIDIA. Il recupero utilizza un criterio fisso per l’host HTTPS assets.ngc.nvidia.com. Se non è configurata alcuna chiave API NVIDIA oppure se il feed non è disponibile o non è valido, OpenClaw utilizza come ripiego il catalogo incluso e il valore predefinito incluso descritti di seguito.

Nemotron 3 Ultra

Nemotron 3 Ultra è il modello NVIDIA predefinito in OpenClaw. La pagina di NVIDIA relativa a nvidia/nemotron-3-ultra-550b-a55b lo indica come endpoint gratuito disponibile, con una specifica di contesto pari a 1 milione di token. La riga Ultra inclusa invia per impostazione predefinita chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }, affinché il normale output della chat rimanga nella risposta visibile anziché esporre il testo del ragionamento. Usa Ultra come opzione NVIDIA predefinita con le capacità più elevate. Mantieni selezionato Super quando desideri l’opzione Nemotron 3 più piccola oppure scegli uno dei modelli di terze parti ospitati nel catalogo NVIDIA quando il relativo contesto, la latenza o il comportamento sono più adatti.

Catalogo di ripiego incluso

Le righe selezionabili incluse rappresentano un’istantanea del catalogo dei modelli in evidenza di NVIDIA. Le righe di compatibilità deprecate rimangono risolvibili tramite il riferimento esatto, ma non vengono visualizzate nei selettori dei modelli. Il catalogo completo di compatibilità conserva inoltre questi riferimenti distribuiti per le configurazioni esistenti: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 e nvidia/minimaxai/minimax-m2.7. Rimangono disponibili tramite il riferimento esatto, ma non vengono mai visualizzati durante la configurazione iniziale o nei selettori dei modelli.

Configurazione avanzata

Il provider si attiva automaticamente quando è impostata la variabile d’ambiente NVIDIA_API_KEY oppure quando una chiave è stata memorizzata durante la configurazione iniziale. Oltre alla chiave, non è richiesta alcuna configurazione esplicita del provider.
OpenClaw preferisce il catalogo pubblico dei modelli in evidenza di NVIDIA quando è configurata l’autenticazione NVIDIA e lo memorizza nella cache per 24 ore. Il catalogo di ripiego selezionabile incluso è un’istantanea statica del catalogo dei modelli in evidenza di NVIDIA; le righe di compatibilità deprecate accessibili tramite riferimento esatto sono nascoste nei selettori dei modelli. I costi hanno come valore predefinito 0 nel codice sorgente, poiché NVIDIA offre attualmente l’accesso API gratuito ai modelli elencati.
OpenClaw comunica con NVIDIA utilizzando l’adattatore openai-completions tramite la route standard /v1 per i completamenti di chat. Qualsiasi strumento compatibile con OpenAI dovrebbe funzionare immediatamente con l’URL di base NVIDIA.
La richiesta di esempio di NVIDIA per Ultra utilizza chat_template_kwargs.enable_thinking e reasoning_budget per l’output del ragionamento. La riga Ultra inclusa in OpenClaw disabilita per impostazione predefinita il ragionamento del modello per il normale utilizzo in chat. Se devi attivare l’output di ragionamento NVIDIA o forzare altri campi della richiesta specifici di NVIDIA, imposta i parametri per modello e limita le sostituzioni specifiche del provider al modello NVIDIA:
params.chat_template_kwargs viene unito a qualsiasi chat_template_kwargs già presente nella richiesta, anziché sostituire l’intero oggetto. params.extra_body è la sostituzione finale del corpo della richiesta compatibile con OpenAI e sovrascrive le chiavi del payload in conflitto; usalo quindi solo per i campi che NVIDIA documenta per l’endpoint selezionato.
Alcuni modelli personalizzati ospitati da NVIDIA possono impiegare più del periodo predefinito di circa 120 secondi del controllo di inattività del modello prima di emettere il primo frammento di risposta. Per le voci personalizzate del provider NVIDIA, aumenta il timeout del provider anziché quello dell’intero ambiente di esecuzione dell’agente; timeoutSeconds si applica alle richieste HTTP del provider e aumenta il limite del controllo di inattività e del flusso per tale provider:
L’utilizzo dei modelli NVIDIA è attualmente gratuito. Consulta build.nvidia.com per le informazioni più recenti sulla disponibilità e sui limiti di frequenza.

Contenuti correlati

Selezione del modello

Scelta dei provider, dei riferimenti dei modelli e del comportamento di failover.

Riferimento della configurazione

Riferimento completo della configurazione per agenti, modelli e provider.