Skip to main content
inferrs udostępnia lokalne modele za pośrednictwem interfejsu API /v1 zgodnego z OpenAI. OpenClaw komunikuje się z nim przez ogólny adapter openai-completions.
inferrs to niestandardowy, samodzielnie hostowany backend zgodny z OpenAI, a nie dedykowany Plugin dostawcy OpenClaw: konfiguruje się go w models.providers.inferrs, zamiast wybierać opcję uwierzytelniania podczas wdrażania. Informacje o dołączonym Pluginie z automatycznym wykrywaniem można znaleźć w sekcji SGLang lub vLLM.

Pierwsze kroki

1

Uruchom inferrs z modelem

2

Sprawdź, czy serwer jest osiągalny

3

Dodaj wpis dostawcy OpenClaw

Dodaj jawny wpis dostawcy i ustaw go jako źródło domyślnego modelu. Zobacz poniższy przykład konfiguracji.

Pełny przykład konfiguracji

Gemma 4 na lokalnym serwerze inferrs:

Uruchamianie na żądanie

OpenClaw może samodzielnie uruchomić inferrs tylko po wybraniu modelu inferrs/.... Dodaj localService do tego samego wpisu dostawcy:
command musi być ścieżką bezwzględną. Uruchom which inferrs na hoście Gateway i użyj zwróconej ścieżki. Pełny opis pól: Usługi modeli lokalnych.

Konfiguracja zaawansowana

Niektóre trasy Chat Completions w inferrs akceptują w messages[].content wyłącznie ciągi znaków, a nie ustrukturyzowane tablice części treści.
Jeśli uruchomienia OpenClaw kończą się błędem:
ustaw compat.requiresStringContent: true we wpisie modelu. OpenClaw przed wysłaniem żądania spłaszczy wtedy części zawierające wyłącznie tekst do zwykłych ciągów znaków.
Niektóre kombinacje inferrs i Gemma akceptują małe, bezpośrednie żądania /v1/chat/completions, ale nie obsługują pełnych tur środowiska wykonawczego agenta OpenClaw. Najpierw spróbuj wyłączyć powierzchnię schematu narzędzi:
Zmniejsza to obciążenie promptu w bardziej restrykcyjnych lokalnych backendach. Jeśli niewielkie bezpośrednie żądania nadal działają, ale zwykłe tury agenta OpenClaw wciąż powodują awarię wewnątrz inferrs, potraktuj to jako ograniczenie modelu lub serwera nadrzędnego, a nie problem warstwy transportowej OpenClaw.
Po skonfigurowaniu przetestuj obie warstwy:
Jeśli pierwsze polecenie działa, a drugie kończy się niepowodzeniem, zobacz poniższą sekcję Rozwiązywanie problemów.
Ponieważ inferrs używa ogólnego adaptera openai-completions (a nie openai-responses), formatowanie żądań przeznaczone wyłącznie dla natywnego OpenAI nigdy nie jest stosowane: nie są wysyłane service_tier, store z Responses, wskazówki dotyczące pamięci podręcznej promptów ani formatowanie ładunku zgodności rozumowania OpenAI.

Rozwiązywanie problemów

inferrs nie działa, jest nieosiągalny albo nie jest powiązany ze skonfigurowanym hostem lub portem. Upewnij się, że serwer jest uruchomiony i nasłuchuje pod tym adresem.
Ustaw compat.requiresStringContent: true we wpisie modelu (patrz wyżej).
Ustaw compat.supportsTools: false, aby wyłączyć powierzchnię schematu narzędzi (zobacz powyższe zastrzeżenie dotyczące Gemma).
Jeśli błędy schematu zniknęły, ale inferrs nadal ulega awarii podczas większych tur agenta, potraktuj to jako ograniczenie nadrzędnego serwera inferrs lub modelu. Zmniejsz obciążenie promptu albo zmień backend lub model.
Ogólną pomoc znajdziesz w sekcjach Rozwiązywanie problemów i Często zadawane pytania.

Powiązane materiały

Modele lokalne

Uruchamianie OpenClaw z lokalnymi serwerami modeli.

Usługi modeli lokalnych

Uruchamianie na żądanie lokalnych serwerów modeli dla skonfigurowanych dostawców.

Rozwiązywanie problemów z Gateway

Diagnozowanie lokalnych backendów zgodnych z OpenAI, które przechodzą testy kontrolne, ale nie obsługują uruchomień agenta.

Wybór modelu

Omówienie wszystkich dostawców, odwołań do modeli i działania przełączania awaryjnego.