Skip to main content
NVIDIA stellt offene Modelle kostenlos über eine OpenAI-kompatible API unter https://integrate.api.nvidia.com/v1 bereit. Die Authentifizierung erfolgt mit einem API-Schlüssel von build.nvidia.com. OpenClaw verwendet für den NVIDIA-Provider standardmäßig Nemotron 3 Ultra, NVIDIAs Reasoning-Modell mit insgesamt 550B / 55B aktiven Parametern für agentische Aufgaben mit langem Kontext.

Erste Schritte

1

API-Schlüssel abrufen

Erstellen Sie einen API-Schlüssel unter build.nvidia.com.
2

Schlüssel exportieren und Onboarding ausführen

3

Ein NVIDIA-Modell festlegen

Übergeben Sie den Schlüssel für eine nicht interaktive Einrichtung direkt:
--nvidia-api-key speichert den Schlüssel im Shell-Verlauf und in der Ausgabe von ps. Verwenden Sie nach Möglichkeit die Umgebungsvariable NVIDIA_API_KEY.

Konfigurationsbeispiel

Empfohlener Katalog

Wenn ein NVIDIA-API-Schlüssel konfiguriert ist, rufen die Einrichtungs- und Modellauswahlpfade NVIDIAs öffentlichen Katalog empfohlener Modelle von https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json ab und speichern das Ergebnis 24 Stunden lang im Cache (die ersten 32 Einträge werden als Zeilen für Freitexteingaben importiert). Neue empfohlene Modelle von build.nvidia.com erscheinen daher in den Einrichtungs- und Modellauswahloberflächen, ohne dass auf eine OpenClaw-Veröffentlichung gewartet werden muss. Wenn der Live-Feed verfügbar ist, ist das erste zurückgegebene Modell während der NVIDIA-Einrichtung vorausgewählt. Der Abruf verwendet eine feste HTTPS-Hostrichtlinie für assets.ngc.nvidia.com. Wenn kein NVIDIA-API-Schlüssel konfiguriert oder der Feed nicht verfügbar beziehungsweise fehlerhaft ist, greift OpenClaw auf den unten aufgeführten mitgelieferten Katalog und den mitgelieferten Standardwert zurück.

Nemotron 3 Ultra

Nemotron 3 Ultra ist das standardmäßige NVIDIA-Modell in OpenClaw. NVIDIAs Build-Seite für nvidia/nemotron-3-ultra-550b-a55b führt es als verfügbaren kostenlosen Endpunkt mit einer Kontextangabe von 1M Token auf. Die mitgelieferte Ultra-Zeile sendet standardmäßig chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }, damit normale Chat-Ausgaben in der sichtbaren Antwort verbleiben, statt Reasoning-Text offenzulegen. Verwenden Sie Ultra als leistungsfähigste NVIDIA-Standardeinstellung. Lassen Sie Super ausgewählt, wenn Sie die kleinere Nemotron-3-Option verwenden möchten, oder wählen Sie eines der in NVIDIAs Katalog gehosteten Drittanbietermodelle, wenn dessen Kontext, Latenz oder Verhalten besser geeignet ist.

Mitgelieferter Fallback-Katalog

Die auswählbaren mitgelieferten Zeilen bilden eine Momentaufnahme von NVIDIAs Katalog empfohlener Modelle. Veraltete Kompatibilitätszeilen bleiben über ihre exakte Referenz auflösbar, werden jedoch nicht in Modellauswahlfeldern angezeigt. Der vollständige Kompatibilitätskatalog enthält außerdem diese veröffentlichten Referenzen für bestehende Konfigurationen: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 und nvidia/minimaxai/minimax-m2.7. Sie bleiben über ihre exakte Referenz verfügbar, erscheinen jedoch nie im Onboarding oder in Modellauswahlfeldern.

Erweiterte Konfiguration

Der Provider wird automatisch aktiviert, wenn die Umgebungsvariable NVIDIA_API_KEY gesetzt ist oder während des Onboardings ein Schlüssel gespeichert wurde. Über den Schlüssel hinaus ist keine explizite Provider-Konfiguration erforderlich.
OpenClaw bevorzugt NVIDIAs öffentlichen Katalog empfohlener Modelle, wenn die NVIDIA-Authentifizierung konfiguriert ist, und speichert ihn 24 Stunden lang im Cache. Der mitgelieferte auswählbare Fallback ist eine statische Momentaufnahme von NVIDIAs Katalog empfohlener Modelle; veraltete Kompatibilitätszeilen mit exakten Referenzen werden in Modellauswahlfeldern ausgeblendet. Die Kosten sind im Quellcode standardmäßig auf 0 gesetzt, da NVIDIA derzeit für die aufgeführten Modelle kostenlosen API-Zugriff anbietet.
OpenClaw kommuniziert mit NVIDIA über den Adapter openai-completions und verwendet dabei die standardmäßige Chat-Completions-Route /v1. Alle OpenAI-kompatiblen Werkzeuge sollten mit der NVIDIA-Basis-URL ohne weitere Konfiguration funktionieren.
NVIDIAs Ultra-Beispielanfrage verwendet chat_template_kwargs.enable_thinking und reasoning_budget für die Reasoning-Ausgabe. Die mitgelieferte Ultra-Zeile von OpenClaw deaktiviert Template-Reasoning standardmäßig für die normale Chat-Nutzung. Wenn Sie die NVIDIA-Reasoning-Ausgabe aktivieren oder andere NVIDIA-spezifische Anfragefelder erzwingen müssen, legen Sie Parameter pro Modell fest und beschränken Sie Provider-spezifische Überschreibungen auf das NVIDIA-Modell:
params.chat_template_kwargs wird mit einem bereits in der Anfrage vorhandenen chat_template_kwargs zusammengeführt, statt das gesamte Objekt zu ersetzen. params.extra_body ist die abschließende OpenAI-kompatible Überschreibung des Anfragekörpers und überschreibt kollidierende Nutzlastschlüssel. Verwenden Sie sie daher nur für Felder, die NVIDIA für den ausgewählten Endpunkt dokumentiert.
Einige von NVIDIA gehostete benutzerdefinierte Modelle können länger als der standardmäßige Modellinaktivitäts-Watchdog von ~120s benötigen, bevor sie das erste Antwortfragment ausgeben. Erhöhen Sie für benutzerdefinierte NVIDIA-Provider-Einträge das Provider-Zeitlimit statt des Zeitlimits der gesamten Agent-Laufzeit; timeoutSeconds gilt für HTTP-Anfragen des Providers und erhöht die Obergrenze des Inaktivitäts-/Stream-Watchdogs für diesen Provider:
NVIDIA-Modelle können derzeit kostenlos genutzt werden. Aktuelle Angaben zur Verfügbarkeit und zu Ratenbegrenzungen finden Sie unter build.nvidia.com.

Verwandte Themen

Modellauswahl

Auswahl von Providern, Modellreferenzen und Failover-Verhalten.

Konfigurationsreferenz

Vollständige Konfigurationsreferenz für Agenten, Modelle und Provider.