Skip to main content
NVIDIA udostępnia bezpłatnie otwarte modele za pośrednictwem interfejsu API zgodnego z OpenAI pod adresem https://integrate.api.nvidia.com/v1, uwierzytelnianego kluczem API z serwisu build.nvidia.com. OpenClaw domyślnie używa dla dostawcy NVIDIA modelu Nemotron 3 Ultra — modelu rozumującego NVIDIA o łącznej liczbie 550 mld parametrów, z czego 55 mld jest aktywnych, przeznaczonego do agentowych zadań z długim kontekstem.

Pierwsze kroki

1

Uzyskaj klucz API

Utwórz klucz API w serwisie build.nvidia.com.
2

Wyeksportuj klucz i uruchom konfigurację początkową

3

Ustaw model NVIDIA

W przypadku konfiguracji nieinteraktywnej przekaż klucz bezpośrednio:
Opcja --nvidia-api-key zapisuje klucz w historii powłoki i danych wyjściowych polecenia ps. Jeśli to możliwe, używaj zmiennej środowiskowej NVIDIA_API_KEY.

Przykład konfiguracji

Wyróżniony katalog

Gdy skonfigurowano klucz API NVIDIA, ścieżki konfiguracji i wyboru modelu pobierają publiczny katalog wyróżnionych modeli NVIDIA z adresu https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json i przechowują wynik w pamięci podręcznej przez 24 godziny (pierwsze 32 pozycje, importowane jako wiersze obsługujące wprowadzanie tekstu bez opłat). Dzięki temu nowe wyróżnione modele z build.nvidia.com pojawiają się w interfejsach konfiguracji i wyboru modelu bez oczekiwania na wydanie OpenClaw. Gdy źródło danych na żywo jest dostępne, pierwszy zwrócony model jest wstępnie wybraną opcją podczas konfiguracji NVIDIA. Pobieranie korzysta ze stałych zasad dotyczących hosta HTTPS assets.ngc.nvidia.com. Jeśli nie skonfigurowano klucza API NVIDIA albo źródło danych jest niedostępne lub ma nieprawidłowy format, OpenClaw korzysta z poniższego wbudowanego katalogu i wbudowanego modelu domyślnego.

Nemotron 3 Ultra

Nemotron 3 Ultra jest domyślnym modelem NVIDIA w OpenClaw. Strona NVIDIA dotycząca nvidia/nemotron-3-ultra-550b-a55b wskazuje go jako dostępny bezpłatny punkt końcowy z kontekstem obejmującym 1 mln tokenów. Wbudowany wpis Ultra domyślnie wysyła chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }, dzięki czemu standardowe dane wyjściowe czatu pozostają w widocznej odpowiedzi zamiast ujawniać tekst rozumowania. Używaj modelu Ultra jako domyślnej opcji NVIDIA o największych możliwościach. Pozostaw wybrany model Super, gdy potrzebujesz mniejszego wariantu Nemotron 3, albo wybierz jeden z modeli innych firm hostowanych w katalogu NVIDIA, jeśli lepiej odpowiadają Ci jego kontekst, opóźnienie lub działanie.

Wbudowany katalog zapasowy

Dostępne do wyboru wbudowane wpisy stanowią migawkę katalogu wyróżnionych modeli NVIDIA. Przestarzałe wpisy zgodności nadal można rozpoznać na podstawie dokładnego odwołania, ale nie są widoczne w selektorach modeli. Pełny katalog zgodności zachowuje również następujące opublikowane odwołania dla istniejących konfiguracji: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 oraz nvidia/minimaxai/minimax-m2.7. Pozostają dostępne przez dokładne odwołanie, ale nigdy nie pojawiają się podczas konfiguracji początkowej ani w selektorach modeli.

Konfiguracja zaawansowana

Dostawca jest automatycznie włączany, gdy ustawiono zmienną środowiskową NVIDIA_API_KEY lub zapisano klucz podczas konfiguracji początkowej. Poza kluczem nie jest wymagana jawna konfiguracja dostawcy.
Po skonfigurowaniu uwierzytelniania NVIDIA OpenClaw preferuje publiczny katalog wyróżnionych modeli NVIDIA i przechowuje go w pamięci podręcznej przez 24 godziny. Dostępny do wyboru wbudowany katalog zapasowy jest statyczną migawką katalogu wyróżnionych modeli NVIDIA; przestarzałe wpisy zgodności dostępne przez dokładne odwołanie są ukryte w selektorach modeli. W kodzie źródłowym koszty mają domyślnie wartość 0, ponieważ NVIDIA obecnie oferuje bezpłatny dostęp przez API do wymienionych modeli.
OpenClaw komunikuje się z NVIDIA za pomocą adaptera openai-completions przez standardową trasę uzupełnień czatu /v1. Każde narzędzie zgodne z OpenAI powinno działać od razu z bazowym adresem URL NVIDIA.
Przykładowe żądanie NVIDIA dla modelu Ultra używa chat_template_kwargs.enable_thinking i reasoning_budget do generowania danych wyjściowych rozumowania. Wbudowany wpis Ultra w OpenClaw domyślnie wyłącza rozumowanie szablonu przy standardowym korzystaniu z czatu. Jeśli chcesz włączyć dane wyjściowe rozumowania NVIDIA lub wymusić inne pola żądania specyficzne dla NVIDIA, ustaw parametry dla danego modelu i ogranicz nadpisania specyficzne dla dostawcy do modelu NVIDIA:
params.chat_template_kwargs jest scalane z każdym chat_template_kwargs znajdującym się już w żądaniu, zamiast zastępować cały obiekt. params.extra_body stanowi końcowe nadpisanie treści żądania zgodnego z OpenAI i zastępuje kolidujące klucze ładunku, dlatego używaj go wyłącznie dla pól, które NVIDIA dokumentuje dla wybranego punktu końcowego.
Niektóre niestandardowe modele hostowane przez NVIDIA mogą potrzebować więcej czasu niż domyślne około 120 sekund limitu bezczynności modelu, zanim wyemitują pierwszy fragment odpowiedzi. W przypadku niestandardowych wpisów dostawcy NVIDIA zwiększ limit czasu dostawcy zamiast limitu czasu całego środowiska wykonawczego agenta; timeoutSeconds obejmuje żądania HTTP do dostawcy i zwiększa górny limit mechanizmu nadzorującego bezczynność lub strumień dla tego dostawcy:
Korzystanie z modeli NVIDIA jest obecnie bezpłatne. Sprawdź build.nvidia.com, aby uzyskać najnowsze informacje o dostępności i limitach częstotliwości żądań.

Powiązane materiały

Wybór modelu

Wybieranie dostawców, odwołań do modeli i sposobu przełączania awaryjnego.

Dokumentacja konfiguracji

Pełna dokumentacja konfiguracji agentów, modeli i dostawców.