/v1 zgodnego z OpenAI. OpenClaw komunikuje się z nim przez ogólny adapter openai-completions.
inferrs to niestandardowy, samodzielnie hostowany backend zgodny z OpenAI, a nie dedykowany Plugin dostawcy OpenClaw: konfiguruje się go w models.providers.inferrs, zamiast wybierać opcję uwierzytelniania podczas wdrażania. Informacje o dołączonym Pluginie z automatycznym wykrywaniem można znaleźć w sekcji SGLang lub vLLM.Pierwsze kroki
1
Uruchom inferrs z modelem
2
Sprawdź, czy serwer jest osiągalny
3
Dodaj wpis dostawcy OpenClaw
Dodaj jawny wpis dostawcy i ustaw go jako źródło domyślnego modelu. Zobacz poniższy przykład konfiguracji.
Pełny przykład konfiguracji
Gemma 4 na lokalnym serwerzeinferrs:
Uruchamianie na żądanie
OpenClaw może samodzielnie uruchomićinferrs tylko po wybraniu modelu inferrs/.... Dodaj localService do tego samego wpisu dostawcy:
command musi być ścieżką bezwzględną. Uruchom which inferrs na hoście Gateway i użyj zwróconej ścieżki. Pełny opis pól: Usługi modeli lokalnych.
Konfiguracja zaawansowana
Dlaczego requiresStringContent ma znaczenie
Dlaczego requiresStringContent ma znaczenie
Niektóre trasy Chat Completions w
inferrs akceptują w messages[].content wyłącznie ciągi znaków, a nie ustrukturyzowane tablice części treści.Zastrzeżenie dotyczące Gemma i schematu narzędzi
Zastrzeżenie dotyczące Gemma i schematu narzędzi
Niektóre kombinacje Zmniejsza to obciążenie promptu w bardziej restrykcyjnych lokalnych backendach. Jeśli niewielkie bezpośrednie żądania nadal działają, ale zwykłe tury agenta OpenClaw wciąż powodują awarię wewnątrz
inferrs i Gemma akceptują małe, bezpośrednie żądania /v1/chat/completions, ale nie obsługują pełnych tur środowiska wykonawczego agenta OpenClaw. Najpierw spróbuj wyłączyć powierzchnię schematu narzędzi:inferrs, potraktuj to jako ograniczenie modelu lub serwera nadrzędnego, a nie problem warstwy transportowej OpenClaw.Ręczny test podstawowy
Ręczny test podstawowy
Po skonfigurowaniu przetestuj obie warstwy:Jeśli pierwsze polecenie działa, a drugie kończy się niepowodzeniem, zobacz poniższą sekcję Rozwiązywanie problemów.
Działanie w stylu serwera proxy
Działanie w stylu serwera proxy
Ponieważ
inferrs używa ogólnego adaptera openai-completions (a nie openai-responses), formatowanie żądań przeznaczone wyłącznie dla natywnego OpenAI nigdy nie jest stosowane: nie są wysyłane service_tier, store z Responses, wskazówki dotyczące pamięci podręcznej promptów ani formatowanie ładunku zgodności rozumowania OpenAI.Rozwiązywanie problemów
curl /v1/models kończy się niepowodzeniem
curl /v1/models kończy się niepowodzeniem
inferrs nie działa, jest nieosiągalny albo nie jest powiązany ze skonfigurowanym hostem lub portem. Upewnij się, że serwer jest uruchomiony i nasłuchuje pod tym adresem.messages[].content wymaga ciągu znaków
messages[].content wymaga ciągu znaków
Ustaw
compat.requiresStringContent: true we wpisie modelu (patrz wyżej).Bezpośrednie wywołania /v1/chat/completions działają, ale openclaw infer model run kończy się niepowodzeniem
Bezpośrednie wywołania /v1/chat/completions działają, ale openclaw infer model run kończy się niepowodzeniem
Ustaw
compat.supportsTools: false, aby wyłączyć powierzchnię schematu narzędzi (zobacz powyższe zastrzeżenie dotyczące Gemma).inferrs nadal ulega awarii podczas większych tur agenta
inferrs nadal ulega awarii podczas większych tur agenta
Jeśli błędy schematu zniknęły, ale
inferrs nadal ulega awarii podczas większych tur agenta, potraktuj to jako ograniczenie nadrzędnego serwera inferrs lub modelu. Zmniejsz obciążenie promptu albo zmień backend lub model.Powiązane materiały
Modele lokalne
Uruchamianie OpenClaw z lokalnymi serwerami modeli.
Usługi modeli lokalnych
Uruchamianie na żądanie lokalnych serwerów modeli dla skonfigurowanych dostawców.
Rozwiązywanie problemów z Gateway
Diagnozowanie lokalnych backendów zgodnych z OpenAI, które przechodzą testy kontrolne, ale nie obsługują uruchomień agenta.
Wybór modelu
Omówienie wszystkich dostawców, odwołań do modeli i działania przełączania awaryjnego.