/v1 API. OpenClaw communiceert ermee via de generieke openai-completions-adapter.
inferrs is een aangepaste, zelfgehoste OpenAI-compatibele backend en geen specifieke OpenClaw-providerplugin: je configureert deze onder models.providers.inferrs in plaats van een authenticatieoptie tijdens de onboarding te kiezen. Zie SGLang of vLLM voor een gebundelde Plugin met automatische detectie.Aan de slag
1
Start inferrs met een model
2
Controleer of de server bereikbaar is
3
Voeg een OpenClaw-providervermelding toe
Voeg een expliciete providervermelding toe en laat je standaardmodel daarnaar verwijzen. Zie het onderstaande configuratievoorbeeld.
Volledig configuratievoorbeeld
Gemma 4 op een lokaleinferrs-server:
Starten op aanvraag
OpenClaw kaninferrs alleen zelf starten wanneer een inferrs/...-model is geselecteerd. Voeg localService toe aan dezelfde providervermelding:
command moet een absoluut pad zijn. Voer which inferrs uit op de Gateway-host en gebruik dat pad. Volledig veldenoverzicht: Lokale modelservices.
Geavanceerde configuratie
Waarom requiresStringContent belangrijk is
Waarom requiresStringContent belangrijk is
Sommige
inferrs Chat Completions-routes accepteren voor messages[].content alleen tekenreeksen en geen gestructureerde arrays met inhoudsonderdelen.Kanttekening bij Gemma en toolschema's
Kanttekening bij Gemma en toolschema's
Sommige combinaties van Dat verlaagt de promptbelasting voor strengere lokale backends. Als kleine rechtstreekse verzoeken nog steeds werken, maar normale OpenClaw-agentbeurten blijven vastlopen in
inferrs en Gemma accepteren kleine rechtstreekse /v1/chat/completions-verzoeken, maar mislukken bij volledige beurten van de OpenClaw-agentruntime. Probeer eerst het toolschema-oppervlak uit te schakelen:inferrs, beschouw dit dan als een beperking van het upstreammodel of de upstreamserver en niet als een transportprobleem van OpenClaw.Handmatige rooktest
Handmatige rooktest
Test beide lagen nadat ze zijn geconfigureerd:Als de eerste opdracht werkt maar de tweede mislukt, raadpleeg dan Probleemoplossing hieronder.
Proxyachtig gedrag
Proxyachtig gedrag
Omdat
inferrs de generieke openai-completions-adapter gebruikt (en niet openai-responses), wordt uitsluitend voor native OpenAI bedoelde verzoeksvormgeving nooit toegepast: er worden geen service_tier, geen Responses-store, geen hints voor promptcaching en geen OpenAI-payloadvormgeving voor redeneercompatibiliteit verzonden.Probleemoplossing
curl /v1/models mislukt
curl /v1/models mislukt
inferrs wordt niet uitgevoerd, is niet bereikbaar of is niet gekoppeld aan de host/poort die je hebt geconfigureerd. Controleer of de server is gestart en op dat adres luistert.messages[].content verwachtte een tekenreeks
messages[].content verwachtte een tekenreeks
Stel
compat.requiresStringContent: true in bij de modelvermelding (zie hierboven).Rechtstreekse /v1/chat/completions-aanroepen slagen, maar openclaw infer model run mislukt
Rechtstreekse /v1/chat/completions-aanroepen slagen, maar openclaw infer model run mislukt
Stel
compat.supportsTools: false in om het toolschema-oppervlak uit te schakelen (zie de kanttekening bij Gemma hierboven).inferrs blijft vastlopen bij grotere agentbeurten
inferrs blijft vastlopen bij grotere agentbeurten
Als de schemafouten zijn verdwenen, maar
inferrs nog steeds vastloopt bij grotere agentbeurten, beschouw dit dan als een beperking van upstream-inferrs of van het model. Verlaag de promptbelasting of schakel over naar een andere backend of een ander model.Gerelateerd
Lokale modellen
OpenClaw uitvoeren met lokale modelservers.
Lokale modelservices
Lokale modelservers op aanvraag starten voor geconfigureerde providers.
Probleemoplossing voor de Gateway
Problemen opsporen met lokale OpenAI-compatibele backends die controles doorstaan, maar waarbij agentuitvoeringen mislukken.
Modelselectie
Overzicht van alle providers, modelverwijzingen en failovergedrag.