Skip to main content
NVIDIA biedt open modellen gratis aan via een OpenAI-compatibele API op https://integrate.api.nvidia.com/v1, geverifieerd met een API-sleutel van build.nvidia.com. OpenClaw stelt de NVIDIA-provider standaard in op Nemotron 3 Ultra, NVIDIA’s redeneermodel met in totaal 550B / 55B actieve parameters voor agentisch werk met een lange context.

Aan de slag

1

Je API-sleutel ophalen

Maak een API-sleutel aan op build.nvidia.com.
2

De sleutel exporteren en onboarding uitvoeren

3

Een NVIDIA-model instellen

Geef voor een niet-interactieve configuratie de sleutel rechtstreeks door:
--nvidia-api-key plaatst de sleutel in de shellgeschiedenis en de uitvoer van ps. Gebruik indien mogelijk bij voorkeur de omgevingsvariabele NVIDIA_API_KEY.

Configuratievoorbeeld

Uitgelichte catalogus

Wanneer een NVIDIA API-sleutel is geconfigureerd, halen de configuratie- en modelselectiepaden NVIDIA’s openbare catalogus met uitgelichte modellen op van https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json en slaan ze het resultaat 24 uur in de cache op (de eerste 32 vermeldingen, geïmporteerd als rijen met vrije tekstinvoer). Nieuwe uitgelichte modellen van build.nvidia.com verschijnen daardoor in de configuratie- en modelselectie-interfaces zonder op een OpenClaw-release te hoeven wachten. Wanneer de livefeed beschikbaar is, is het eerste geretourneerde model de vooraf geselecteerde optie tijdens de NVIDIA-configuratie. Bij het ophalen wordt een vast HTTPS-hostbeleid gebruikt voor assets.ngc.nvidia.com. Als er geen NVIDIA API-sleutel is geconfigureerd, of als de feed niet beschikbaar of ongeldig is, valt OpenClaw terug op de meegeleverde catalogus en de hieronder vermelde standaardwaarde.

Nemotron 3 Ultra

Nemotron 3 Ultra is het standaard NVIDIA-model in OpenClaw. NVIDIA’s buildpagina voor nvidia/nemotron-3-ultra-550b-a55b vermeldt het als een beschikbaar gratis endpoint met een contextspecificatie van 1M tokens. De meegeleverde Ultra-rij verzendt standaard chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }, zodat normale chatuitvoer in het zichtbare antwoord blijft in plaats van redeneertekst bloot te leggen. Gebruik Ultra als de krachtigste standaardoptie van NVIDIA. Houd Super geselecteerd wanneer je de kleinere Nemotron 3-optie wilt, of kies een van de modellen van derden die in NVIDIA’s catalogus worden gehost wanneer hun context, latentie of gedrag beter aansluit.

Meegeleverde terugvalcatalogus

De selecteerbare meegeleverde rijen zijn een momentopname van NVIDIA’s catalogus met uitgelichte modellen. Verouderde compatibiliteitsrijen blijven via hun exacte referentie beschikbaar, maar worden niet in modelkiezers weergegeven. De volledige compatibiliteitscatalogus behoudt ook deze uitgebrachte referenties voor bestaande configuraties: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 en nvidia/minimaxai/minimax-m2.7. Ze blijven via hun exacte referentie beschikbaar, maar verschijnen nooit in onboarding of modelkiezers.

Geavanceerde configuratie

De provider wordt automatisch ingeschakeld wanneer de omgevingsvariabele NVIDIA_API_KEY is ingesteld of tijdens onboarding een sleutel is opgeslagen. Naast de sleutel is geen expliciete providerconfiguratie vereist.
OpenClaw geeft de voorkeur aan NVIDIA’s openbare catalogus met uitgelichte modellen wanneer NVIDIA-authenticatie is geconfigureerd en slaat deze 24 uur in de cache op. De meegeleverde selecteerbare terugvaloptie is een statische momentopname van NVIDIA’s catalogus met uitgelichte modellen; verouderde compatibiliteitsrijen met een exacte referentie zijn verborgen in modelkiezers. De kosten zijn in de bron standaard ingesteld op 0, aangezien NVIDIA momenteel gratis API-toegang biedt voor de vermelde modellen.
OpenClaw communiceert met NVIDIA via de adapter openai-completions en gebruikt daarbij de standaardroute /v1 voor chatvoltooiingen. Alle OpenAI-compatibele hulpmiddelen zouden direct moeten werken met de NVIDIA-basis-URL.
NVIDIA’s voorbeeldverzoek voor Ultra gebruikt chat_template_kwargs.enable_thinking en reasoning_budget voor redeneeruitvoer. De meegeleverde Ultra-rij van OpenClaw schakelt sjabloondenken standaard uit voor normaal chatgebruik. Als je NVIDIA-redeneeruitvoer wilt inschakelen of andere NVIDIA-specifieke aanvraagvelden wilt afdwingen, stel dan parameters per model in en beperk providerspecifieke overschrijvingen tot het NVIDIA-model:
params.chat_template_kwargs wordt samengevoegd met eventuele chat_template_kwargs die al in de aanvraag aanwezig zijn, in plaats van het volledige object te vervangen. params.extra_body is de definitieve overschrijving van de OpenAI-compatibele aanvraagbody en overschrijft conflicterende payloadsleutels. Gebruik dit daarom alleen voor velden die NVIDIA documenteert voor het geselecteerde endpoint.
Sommige door NVIDIA gehoste aangepaste modellen kunnen langer nodig hebben dan de standaard inactiviteitsbewaking van het model van ~120s voordat ze een eerste antwoordfragment verzenden. Verhoog voor aangepaste NVIDIA-providervermeldingen de providertime-out in plaats van de time-out van de volledige agent-runtime; timeoutSeconds dekt HTTP-aanvragen van de provider en verhoogt de limiet van de inactiviteits-/streambewaking voor die provider:
NVIDIA-modellen zijn momenteel gratis te gebruiken. Controleer build.nvidia.com voor de meest recente beschikbaarheid en details over snelheidslimieten.

Gerelateerd

Modelselectie

Providers, modelreferenties en terugvalgedrag kiezen.

Configuratiereferentie

Volledige configuratiereferentie voor agents, modellen en providers.