Skip to main content
inferrs stellt lokale Modelle hinter einer OpenAI-kompatiblen /v1-API bereit. OpenClaw kommuniziert damit über den generischen openai-completions-Adapter.
inferrs ist ein benutzerdefiniertes, selbst gehostetes OpenAI-kompatibles Backend und kein dediziertes OpenClaw-Provider-Plugin: Sie konfigurieren es unter models.providers.inferrs, statt bei der Ersteinrichtung eine Authentifizierungsoption auszuwählen. Informationen zu einem mitgelieferten Plugin mit automatischer Erkennung finden Sie unter SGLang oder vLLM.

Erste Schritte

1

inferrs mit einem Modell starten

2

Erreichbarkeit des Servers überprüfen

3

Einen OpenClaw-Provider-Eintrag hinzufügen

Fügen Sie einen expliziten Provider-Eintrag hinzu und verweisen Sie mit Ihrem Standardmodell darauf. Siehe das nachfolgende Konfigurationsbeispiel.

Vollständiges Konfigurationsbeispiel

Gemma 4 auf einem lokalen inferrs-Server:

Bedarfsgesteuerter Start

OpenClaw kann inferrs selbst starten, jedoch nur, wenn ein inferrs/...-Modell ausgewählt ist. Fügen Sie localService demselben Provider-Eintrag hinzu:
command muss ein absoluter Pfad sein. Führen Sie which inferrs auf dem Gateway-Host aus und verwenden Sie diesen Pfad. Vollständige Feldreferenz: Lokale Modelldienste.

Erweiterte Konfiguration

Einige inferrs-Chat-Completions-Routen akzeptieren für messages[].content nur Zeichenfolgen und keine strukturierten Arrays aus Inhaltsteilen.
Wenn OpenClaw-Ausführungen mit folgendem Fehler fehlschlagen:
legen Sie compat.requiresStringContent: true im Modelleintrag fest. OpenClaw wandelt dann reine Textinhaltsteile in einfache Zeichenfolgen um, bevor die Anfrage gesendet wird.
Einige Kombinationen aus inferrs und Gemma akzeptieren kleine direkte /v1/chat/completions-Anfragen, schlagen jedoch bei vollständigen Ausführungen der OpenClaw-Agentenlaufzeit fehl. Versuchen Sie zunächst, die Werkzeugschema-Oberfläche zu deaktivieren:
Dadurch wird die Prompt-Belastung für strengere lokale Backends reduziert. Wenn kleine direkte Anfragen weiterhin funktionieren, normale OpenClaw-Agentenausführungen innerhalb von inferrs jedoch weiterhin abstürzen, behandeln Sie dies als Einschränkung des vorgelagerten Modells oder Servers und nicht als OpenClaw-Transportproblem.
Testen Sie nach der Konfiguration beide Ebenen:
Wenn der erste Befehl funktioniert, der zweite jedoch fehlschlägt, lesen Sie den Abschnitt zur Fehlerbehebung weiter unten.
Da inferrs den generischen openai-completions-Adapter verwendet (nicht openai-responses), wird die ausschließlich für natives OpenAI vorgesehene Anfrageformatierung nie angewendet: Es werden weder service_tier, Responses-store oder Prompt-Cache-Hinweise noch OpenAI-Payload-Formatierungen zur Reasoning-Kompatibilität gesendet.

Fehlerbehebung

inferrs wird nicht ausgeführt, ist nicht erreichbar oder nicht an den konfigurierten Host beziehungsweise Port gebunden. Vergewissern Sie sich, dass der Server gestartet wurde und unter dieser Adresse lauscht.
Legen Sie compat.requiresStringContent: true im Modelleintrag fest (siehe oben).
Legen Sie compat.supportsTools: false fest, um die Werkzeugschema-Oberfläche zu deaktivieren (siehe den Hinweis zu Gemma oben).
Wenn die Schemafehler behoben sind, inferrs bei größeren Agentenausführungen jedoch weiterhin abstürzt, behandeln Sie dies als Einschränkung des vorgelagerten inferrs oder des Modells. Reduzieren Sie die Prompt-Belastung oder wechseln Sie das Backend beziehungsweise Modell.
Allgemeine Hilfe finden Sie unter Fehlerbehebung und Häufig gestellte Fragen.

Verwandte Themen

Lokale Modelle

OpenClaw mit lokalen Modellservern ausführen.

Lokale Modelldienste

Lokale Modellserver für konfigurierte Provider bei Bedarf starten.

Gateway-Fehlerbehebung

Fehler in lokalen OpenAI-kompatiblen Backends beheben, die Prüfaufrufe bestehen, bei Agentenausführungen jedoch fehlschlagen.

Modellauswahl

Überblick über alle Provider, Modellreferenzen und das Failover-Verhalten.