Skip to main content
inferrs biedt lokale modellen aan via een OpenAI-compatibele /v1 API. OpenClaw communiceert ermee via de generieke openai-completions-adapter.
inferrs is een aangepaste, zelfgehoste OpenAI-compatibele backend en geen specifieke OpenClaw-providerplugin: je configureert deze onder models.providers.inferrs in plaats van een authenticatieoptie tijdens de onboarding te kiezen. Zie SGLang of vLLM voor een gebundelde Plugin met automatische detectie.

Aan de slag

1

Start inferrs met een model

2

Controleer of de server bereikbaar is

3

Voeg een OpenClaw-providervermelding toe

Voeg een expliciete providervermelding toe en laat je standaardmodel daarnaar verwijzen. Zie het onderstaande configuratievoorbeeld.

Volledig configuratievoorbeeld

Gemma 4 op een lokale inferrs-server:

Starten op aanvraag

OpenClaw kan inferrs alleen zelf starten wanneer een inferrs/...-model is geselecteerd. Voeg localService toe aan dezelfde providervermelding:
command moet een absoluut pad zijn. Voer which inferrs uit op de Gateway-host en gebruik dat pad. Volledig veldenoverzicht: Lokale modelservices.

Geavanceerde configuratie

Sommige inferrs Chat Completions-routes accepteren voor messages[].content alleen tekenreeksen en geen gestructureerde arrays met inhoudsonderdelen.
Als OpenClaw-uitvoeringen mislukken met:
stel dan compat.requiresStringContent: true in bij de modelvermelding. OpenClaw voegt inhoudsonderdelen die uitsluitend tekst bevatten dan samen tot gewone tekenreeksen voordat het verzoek wordt verzonden.
Sommige combinaties van inferrs en Gemma accepteren kleine rechtstreekse /v1/chat/completions-verzoeken, maar mislukken bij volledige beurten van de OpenClaw-agentruntime. Probeer eerst het toolschema-oppervlak uit te schakelen:
Dat verlaagt de promptbelasting voor strengere lokale backends. Als kleine rechtstreekse verzoeken nog steeds werken, maar normale OpenClaw-agentbeurten blijven vastlopen in inferrs, beschouw dit dan als een beperking van het upstreammodel of de upstreamserver en niet als een transportprobleem van OpenClaw.
Test beide lagen nadat ze zijn geconfigureerd:
Als de eerste opdracht werkt maar de tweede mislukt, raadpleeg dan Probleemoplossing hieronder.
Omdat inferrs de generieke openai-completions-adapter gebruikt (en niet openai-responses), wordt uitsluitend voor native OpenAI bedoelde verzoeksvormgeving nooit toegepast: er worden geen service_tier, geen Responses-store, geen hints voor promptcaching en geen OpenAI-payloadvormgeving voor redeneercompatibiliteit verzonden.

Probleemoplossing

inferrs wordt niet uitgevoerd, is niet bereikbaar of is niet gekoppeld aan de host/poort die je hebt geconfigureerd. Controleer of de server is gestart en op dat adres luistert.
Stel compat.requiresStringContent: true in bij de modelvermelding (zie hierboven).
Stel compat.supportsTools: false in om het toolschema-oppervlak uit te schakelen (zie de kanttekening bij Gemma hierboven).
Als de schemafouten zijn verdwenen, maar inferrs nog steeds vastloopt bij grotere agentbeurten, beschouw dit dan als een beperking van upstream-inferrs of van het model. Verlaag de promptbelasting of schakel over naar een andere backend of een ander model.
Zie Probleemoplossing en Veelgestelde vragen voor algemene hulp.

Gerelateerd

Lokale modellen

OpenClaw uitvoeren met lokale modelservers.

Lokale modelservices

Lokale modelservers op aanvraag starten voor geconfigureerde providers.

Probleemoplossing voor de Gateway

Problemen opsporen met lokale OpenAI-compatibele backends die controles doorstaan, maar waarbij agentuitvoeringen mislukken.

Modelselectie

Overzicht van alle providers, modelverwijzingen en failovergedrag.