/v1-API bereit. OpenClaw kommuniziert damit über den generischen openai-completions-Adapter.
inferrs ist ein benutzerdefiniertes, selbst gehostetes OpenAI-kompatibles Backend und kein dediziertes OpenClaw-Provider-Plugin: Sie konfigurieren es unter models.providers.inferrs, statt bei der Ersteinrichtung eine Authentifizierungsoption auszuwählen. Informationen zu einem mitgelieferten Plugin mit automatischer Erkennung finden Sie unter SGLang oder vLLM.Erste Schritte
1
inferrs mit einem Modell starten
2
Erreichbarkeit des Servers überprüfen
3
Einen OpenClaw-Provider-Eintrag hinzufügen
Fügen Sie einen expliziten Provider-Eintrag hinzu und verweisen Sie mit Ihrem Standardmodell darauf. Siehe das nachfolgende Konfigurationsbeispiel.
Vollständiges Konfigurationsbeispiel
Gemma 4 auf einem lokaleninferrs-Server:
Bedarfsgesteuerter Start
OpenClaw kanninferrs selbst starten, jedoch nur, wenn ein inferrs/...-Modell ausgewählt ist. Fügen Sie localService demselben Provider-Eintrag hinzu:
command muss ein absoluter Pfad sein. Führen Sie which inferrs auf dem Gateway-Host aus und verwenden Sie diesen Pfad. Vollständige Feldreferenz: Lokale Modelldienste.
Erweiterte Konfiguration
Warum requiresStringContent wichtig ist
Warum requiresStringContent wichtig ist
Einige
inferrs-Chat-Completions-Routen akzeptieren für messages[].content nur Zeichenfolgen und keine strukturierten Arrays aus Inhaltsteilen.Hinweis zu Gemma und Werkzeugschemas
Hinweis zu Gemma und Werkzeugschemas
Einige Kombinationen aus Dadurch wird die Prompt-Belastung für strengere lokale Backends reduziert. Wenn kleine direkte Anfragen weiterhin funktionieren, normale OpenClaw-Agentenausführungen innerhalb von
inferrs und Gemma akzeptieren kleine direkte /v1/chat/completions-Anfragen, schlagen jedoch bei vollständigen Ausführungen der OpenClaw-Agentenlaufzeit fehl. Versuchen Sie zunächst, die Werkzeugschema-Oberfläche zu deaktivieren:inferrs jedoch weiterhin abstürzen, behandeln Sie dies als Einschränkung des vorgelagerten Modells oder Servers und nicht als OpenClaw-Transportproblem.Manueller Funktionstest
Manueller Funktionstest
Testen Sie nach der Konfiguration beide Ebenen:Wenn der erste Befehl funktioniert, der zweite jedoch fehlschlägt, lesen Sie den Abschnitt zur Fehlerbehebung weiter unten.
Proxy-ähnliches Verhalten
Proxy-ähnliches Verhalten
Da
inferrs den generischen openai-completions-Adapter verwendet (nicht openai-responses), wird die ausschließlich für natives OpenAI vorgesehene Anfrageformatierung nie angewendet: Es werden weder service_tier, Responses-store oder Prompt-Cache-Hinweise noch OpenAI-Payload-Formatierungen zur Reasoning-Kompatibilität gesendet.Fehlerbehebung
curl /v1/models schlägt fehl
curl /v1/models schlägt fehl
inferrs wird nicht ausgeführt, ist nicht erreichbar oder nicht an den konfigurierten Host beziehungsweise Port gebunden. Vergewissern Sie sich, dass der Server gestartet wurde und unter dieser Adresse lauscht.messages[].content erwartet eine Zeichenfolge
messages[].content erwartet eine Zeichenfolge
Legen Sie
compat.requiresStringContent: true im Modelleintrag fest (siehe oben).Direkte /v1/chat/completions-Aufrufe funktionieren, aber openclaw infer model run schlägt fehl
Direkte /v1/chat/completions-Aufrufe funktionieren, aber openclaw infer model run schlägt fehl
Legen Sie
compat.supportsTools: false fest, um die Werkzeugschema-Oberfläche zu deaktivieren (siehe den Hinweis zu Gemma oben).inferrs stürzt bei größeren Agentenausführungen weiterhin ab
inferrs stürzt bei größeren Agentenausführungen weiterhin ab
Wenn die Schemafehler behoben sind,
inferrs bei größeren Agentenausführungen jedoch weiterhin abstürzt, behandeln Sie dies als Einschränkung des vorgelagerten inferrs oder des Modells. Reduzieren Sie die Prompt-Belastung oder wechseln Sie das Backend beziehungsweise Modell.Verwandte Themen
Lokale Modelle
OpenClaw mit lokalen Modellservern ausführen.
Lokale Modelldienste
Lokale Modellserver für konfigurierte Provider bei Bedarf starten.
Gateway-Fehlerbehebung
Fehler in lokalen OpenAI-kompatiblen Backends beheben, die Prüfaufrufe bestehen, bei Agentenausführungen jedoch fehlschlagen.
Modellauswahl
Überblick über alle Provider, Modellreferenzen und das Failover-Verhalten.