openclaw infer ist die kanonische Headless-Oberfläche für providergestützte Inferenz. Sie stellt Funktionsfamilien (model, image, audio, tts, video, web, embedding) bereit, nicht die unverarbeiteten RPC-Namen des Gateways oder IDs von Agent-Tools. openclaw capability ... ist ein Alias für denselben Befehlsbaum.
Gründe, sie einem einmalig erstellten Provider-Wrapper vorzuziehen:
- Verwendet bereits in OpenClaw konfigurierte Provider und Modelle wieder.
- Stabile
--json-Hülle für Skripte und agentengesteuerte Automatisierung (siehe JSON-Ausgabe). - Führt für die meisten Unterbefehle den normalen lokalen Pfad ohne Gateway aus.
- Für End-to-End-Prüfungen von Providern testet sie die ausgelieferte CLI, das Laden der Konfiguration, die Auflösung des Standard-Agenten, die Aktivierung gebündelter Plugins und die gemeinsame Funktionslaufzeit, bevor die Provider-Anfrage gesendet wird.
infer in ein Skill umwandeln
Kopieren Sie Folgendes und fügen Sie es bei einem Agenten ein:openclaw infer ... gegenüber Alternativen auf niedrigerer Ebene und dokumentiert nicht die gesamte infer-Oberfläche erneut im Skill-Inhalt.
Befehlsbaum
infer list / infer inspect --name <capability> zeigen diesen Baum als Daten an (Funktions-ID, Transporte, Beschreibung).
Häufige Aufgaben
Verhalten
- Verwenden Sie
--json, wenn die Ausgabe einem anderen Befehl oder Skript zugeführt wird; andernfalls die Textausgabe. - Verwenden Sie
--provideroder--model provider/model, um ein bestimmtes Backend festzulegen. - Verwenden Sie
model run --thinking <level>, um das Denken/Schlussfolgern einmalig zu überschreiben:off,minimal,low,medium,high,adaptive,xhighodermax. - Für
image describe,audio transcribeundvideo describemuss--modeldie Form<provider/model>verwenden. - Für
image describeakzeptiert--filelokale Pfade und HTTP(S)-URLs; Remote-URLs unterliegen der normalen SSRF-Richtlinie für den Medienabruf. - Zustandslose Ausführungsbefehle (
model run,image *,audio *,video *,web *,embedding *) werden standardmäßig lokal ausgeführt. Vom Gateway verwaltete Zustandsbefehle (tts status) verwenden standardmäßig das Gateway. - Für den lokalen Pfad muss das Gateway niemals ausgeführt werden.
- Lokales
model runist eine schlanke, einmalige Provider-Vervollständigung: Es löst das konfigurierte Agentenmodell und die Authentifizierung auf, startet jedoch keinen Chat-Agenten-Turn, lädt keine Tools und öffnet keine gebündelten MCP-Server. model run --filehängt Bilddateien (automatisch erkannter MIME-Typ) an den Prompt an; wiederholen Sie--filefür mehrere Bilder. Dateien, die keine Bilder sind, werden abgelehnt — verwenden Sie stattdesseninfer audio transcribeoderinfer video describe.model run --gatewaytestet das Gateway-Routing, gespeicherte Authentifizierung, Provider-Auswahl und die eingebettete Laufzeit, bleibt aber eine unverarbeitete Modellprüfung: kein vorheriges Sitzungstranskript, kein Bootstrap-/AGENTS-Kontext, keine Tools und keine gebündelten MCP-Server.model run --gateway --model <provider/model>erfordert Gateway-Anmeldedaten eines vertrauenswürdigen Operators, da der Befehl das Gateway auffordert, eine einmalige Provider-/Modellüberschreibung auszuführen.
Modell
Textinferenz und Modell-/Provider-Überprüfung.<provider/model>-Referenzen mit --local, um einen Provider zu testen, ohne das Gateway zu starten oder die Tool-Oberfläche des Agenten zu laden:
- Lokales
model runist die engste CLI-Prüfung für den Zustand von Provider, Modell und Authentifizierung: Für Provider außer ChatGPT-Codex sendet es ausschließlich den angegebenen Prompt. - Lokales
model run --model <provider/model>kann genaue Zeilen aus dem gebündelten statischen Katalog auflösen (dieselben Zeilen, dieopenclaw models list --allanzeigt), bevor dieser Provider in die Konfiguration geschrieben wird. Eine Provider-Authentifizierung ist weiterhin erforderlich; fehlende Anmeldedaten führen zu Authentifizierungsfehlern, nicht zuUnknown model. - Lassen Sie bei Schlussfolgerungsprüfungen mit Mistral Medium 3.5 die Temperatur nicht gesetzt bzw. auf dem Standardwert. Mistral lehnt
reasoning_effort="high"mittemperature: 0ab; verwenden Sie die Standardtemperatur oder einen Wert ungleich null wie0.7. - Lokale Prüfungen mit OpenAI ChatGPT/Codex OAuth (
openai-chatgpt-responses-API) fügen eine minimale Systemanweisung hinzu, damit der Transport sein erforderliches Feldinstructionsausfüllen kann — ohne vollständigen Agentenkontext, Tools, Speicher oder Sitzungstranskript. model run --filehängt Bildinhalte direkt an die einzelne Benutzernachricht an. Gängige Formate (PNG, JPEG, WebP) funktionieren, wenn der MIME-Typ alsimage/*erkannt wird; nicht unterstützte oder nicht erkannte Dateien schlagen fehl, bevor der Provider aufgerufen wird. Verwenden Sie stattdesseninfer image describe, wenn Sie das Bildmodell-Routing und die Fallbacks von OpenClaw anstelle einer direkten Prüfung eines multimodalen Modells verwenden möchten.- Das ausgewählte Modell muss Bildeingaben unterstützen; reine Textmodelle können die Anfrage auf Provider-Ebene ablehnen.
model run --promptmuss Text enthalten, der nicht nur aus Leerzeichen besteht; leere Prompts werden vor jedem Provider- oder Gateway-Aufruf abgelehnt.- Lokales
model runwird mit einem Exit-Code ungleich null beendet, wenn der Provider keine Textausgabe zurückgibt, sodass nicht erreichbare Provider und leere Vervollständigungen nicht wie erfolgreiche Prüfungen erscheinen. - Verwenden Sie
model run --gateway, um das Gateway-Routing oder die Einrichtung der Agentenlaufzeit zu testen und dabei die Modelleingabe unverändert zu lassen. Verwenden Sieopenclaw agentoder eine Chat-Oberfläche für vollständigen Agentenkontext, Tools, Speicher und Sitzungstranskript. --thinking adaptivewird der Ebenemediumder Vervollständigungs-Laufzeit zugeordnet;--thinking maxwird für OpenAI-Modelle, die den nativen maximalen Aufwand unterstützen,maxzugeordnet, andernfallsxhigh.model auth login,model auth logoutundmodel auth statusverwalten den gespeicherten Authentifizierungsstatus des Providers.
Bild
Erzeugung, Bearbeitung und Beschreibung.-
Verwenden Sie
image edit, wenn Sie mit vorhandenen Eingabedateien beginnen;--size,--aspect-ratiooder--resolutionfügen Geometriehinweise für Provider/Modelle hinzu, die diese unterstützen. -
--output-format png --background transparentmit--model openai/gpt-image-1.5erzeugt eine OpenAI-PNG-Ausgabe mit transparentem Hintergrund;--openai-backgroundist ein OpenAI-spezifischer Alias für denselben Hinweis. Provider, die keine Hintergrundunterstützung deklarieren, melden ihn als ignorierte Überschreibung (sieheignoredOverridesim JSON-Umschlag). -
--quality low|medium|high|autofunktioniert bei Providern, die Bildqualitätshinweise unterstützen, einschließlich OpenAI. OpenAI akzeptiert außerdem--openai-moderation low|auto. -
image providers --jsonlistet auf, welche gebündelten Bild-Provider auffindbar, konfiguriert und ausgewählt sind und welche Generierungs-/Bearbeitungsfunktionen sie jeweils bereitstellen. -
image generate --model <provider/model> --jsonist der zielgerichtetste Live-Smoke-Test für Änderungen an der Bilderzeugung:Die Antwort meldetok,provider,model,attemptsund die Pfade der geschriebenen Ausgaben. Wenn--outputgesetzt ist, kann die endgültige Erweiterung dem vom Provider zurückgegebenen MIME-Typ entsprechen. -
Verwenden Sie für
image describeundimage describe-manydie Option--promptfür eine aufgabenspezifische Anweisung (OCR, Vergleich, UI-Inspektion, prägnante Bildunterschrift). -
Verwenden Sie
--timeout-msfür langsame lokale Vision-Modelle oder Kaltstarts von Ollama. -
Für
image describewird zuerst ein explizites--model(muss ein bildfähiges<provider/model>sein) ausgeführt. Wenn dieser Aufruf fehlschlägt, werden anschließend konfigurierteagents.defaults.imageModel.fallbacksausprobiert. Fehler bei der Eingabevorbereitung (fehlende Datei, nicht unterstützte URL) führen vor jedem Fallback-Versuch zum Fehlschlag, und das Modell muss im Modellkatalog oder in der Provider-Konfiguration als bildfähig ausgewiesen sein. -
Rufen Sie bei lokalen Ollama-Vision-Modellen zuerst das Modell ab und setzen Sie
OLLAMA_API_KEYauf einen beliebigen Platzhalterwert, beispielsweiseollama-local. Siehe Ollama.
Audio
Dateitranskription (keine Verwaltung von Echtzeitsitzungen).--model muss <provider/model> sein.
TTS
Sprachsynthese und TTS-Provider-/Persona-Status.tts statusunterstützt nur--gateway(es spiegelt den vom Gateway verwalteten TTS-Status wider).- Verwenden Sie
tts providers,tts voices,tts personas,tts set-providerundtts set-persona, um das TTS-Verhalten zu prüfen und zu konfigurieren.
Video
Generierung und Beschreibung.video generateakzeptiert--size,--aspect-ratio,--resolution,--duration,--audio,--watermarkund--timeout-ms, die an die Laufzeitumgebung für die Videogenerierung weitergeleitet werden.--modelmuss fürvideo describeden Wert<provider/model>haben.
Web
Suche und Abruf.web providers listet die verfügbaren, konfigurierten und ausgewählten Provider für Suche und Abruf auf.
Einbettung
Vektorerstellung und Prüfung von Einbettungs-Providern.JSON-Ausgabe
Infer-Befehle normalisieren die JSON-Ausgabe unter einem gemeinsamen Umschlag:okcapabilitytransportprovidermodelattemptsinputs(mit der Anfrage gesendete Bildanhänge, falls zutreffend)outputsignoredOverrides(Hinweisschlüssel, die ein Provider nicht unterstützt, falls zutreffend)error
outputs die von OpenClaw geschriebenen Dateien. Verwenden Sie für die Automatisierung path, mimeType, size und alle medienspezifischen Abmessungen in diesem Array, anstatt die menschenlesbare Standardausgabe zu parsen.