openclaw infer jest kanonicznym bezinterfejsowym punktem dostępu do wnioskowania obsługiwanego przez dostawców. Udostępnia rodziny możliwości (model, image, audio, tts, video, web, embedding), a nie surowe nazwy RPC Gateway ani identyfikatory narzędzi agenta. openclaw capability ... jest aliasem tego samego drzewa poleceń.
Powody, dla których warto go używać zamiast jednorazowej otoczki dostawcy:
- Ponownie wykorzystuje dostawców i modele już skonfigurowane w OpenClaw.
- Zapewnia stabilną kopertę
--jsondla skryptów i automatyzacji sterowanej przez agenta (zobacz Dane wyjściowe JSON). - W przypadku większości podpoleceń uruchamia standardową ścieżkę lokalną bez Gateway.
- W przypadku kompleksowych testów dostawcy sprawdza dostarczany CLI, wczytywanie konfiguracji, rozpoznawanie domyślnego agenta, aktywację dołączonych pluginów oraz współdzielone środowisko wykonawcze możliwości przed wysłaniem żądania do dostawcy.
Przekształcanie infer w Skills
Skopiuj poniższy tekst i wklej go agentowi:openclaw infer ... zamiast alternatyw niższego poziomu i nie dokumentują ponownie całego interfejsu infer w swojej treści.
Drzewo poleceń
infer list / infer inspect --name <capability> przedstawiają to drzewo jako dane (identyfikator możliwości, transporty, opis).
Typowe zadania
Działanie
- Używaj
--json, gdy dane wyjściowe są przekazywane do innego polecenia lub skryptu; w przeciwnym razie używaj danych tekstowych. - Użyj
--providerlub--model provider/model, aby wskazać konkretny backend. - Użyj
model run --thinking <level>, aby jednorazowo nadpisać poziom myślenia/rozumowania:off,minimal,low,medium,high,adaptive,xhighlubmax. - W przypadku
image describe,audio transcribeivideo describeopcja--modelmusi mieć postać<provider/model>. - W przypadku
image describeopcja--fileprzyjmuje ścieżki lokalne i adresy URL HTTP(S); zdalne adresy URL podlegają standardowej polityce SSRF pobierania multimediów. - Bezstanowe polecenia wykonawcze (
model run,image *,audio *,video *,web *,embedding *) są domyślnie lokalne. Polecenia stanu zarządzanego przez Gateway (tts status) domyślnie używają Gateway. - Ścieżka lokalna nigdy nie wymaga uruchomionego Gateway.
- Lokalne
model runto uproszczone, jednorazowe wywołanie uzupełniania przez dostawcę: rozpoznaje skonfigurowany model agenta i uwierzytelnianie, ale nie rozpoczyna tury agenta czatu, nie ładuje narzędzi ani nie otwiera dołączonych serwerów MCP. model run --filedołącza pliki obrazów (z automatycznie wykrywanym typem MIME) do promptu; powtórz--file, aby przekazać wiele obrazów. Pliki niebędące obrazami są odrzucane — zamiast tego użyjinfer audio transcribelubinfer video describe.model run --gatewaysprawdza trasowanie Gateway, zapisane dane uwierzytelniające, wybór dostawcy i osadzone środowisko wykonawcze, ale pozostaje surowym testem modelu: bez wcześniejszej transkrypcji sesji, kontekstu startowego/AGENTS, narzędzi ani dołączonych serwerów MCP.model run --gateway --model <provider/model>wymaga poświadczenia Gateway zaufanego operatora, ponieważ polecenie żąda od Gateway jednorazowego nadpisania dostawcy/modelu.
Model
Wnioskowanie tekstowe oraz inspekcja modeli/dostawców.<provider/model> z opcją --local, aby wykonać test dymny jednego dostawcy bez uruchamiania Gateway ani ładowania zestawu narzędzi agenta:
- Lokalne
model runjest najbardziej ukierunkowanym testem dymnym CLI dotyczącym kondycji dostawcy/modelu/uwierzytelniania: w przypadku dostawców innych niż ChatGPT-Codex wysyła wyłącznie podany prompt. - Lokalne
model run --model <provider/model>może rozpoznać dokładne wiersze dołączonego katalogu statycznego (te same, które pokazujeopenclaw models list --all), zanim dany dostawca zostanie zapisany w konfiguracji. Uwierzytelnienie dostawcy jest nadal wymagane; brakujące dane uwierzytelniające powodują błędy uwierzytelniania, a nieUnknown model. - W przypadku testów rozumowania Mistral Medium 3.5 pozostaw temperaturę nieustawioną/domyślną. Mistral odrzuca
reasoning_effort="high"ztemperature: 0; użyj domyślnej temperatury lub wartości niezerowej, takiej jak0.7. - Lokalne testy OAuth OpenAI ChatGPT/Codex (API
openai-chatgpt-responses) dodają minimalną instrukcję systemową, aby transport mógł wypełnić wymagane poleinstructions— bez pełnego kontekstu agenta, narzędzi, pamięci ani transkrypcji sesji. model run --filedołącza zawartość obrazu bezpośrednio do pojedynczej wiadomości użytkownika. Typowe formaty (PNG, JPEG, WebP) działają, gdy typ MIME zostanie wykryty jakoimage/*; nieobsługiwane lub nierozpoznane pliki powodują błąd przed wywołaniem dostawcy. Użyj zamiast tegoinfer image describe, jeśli zamiast bezpośredniego testu modelu multimodalnego chcesz użyć trasowania modeli obrazowych i mechanizmów awaryjnych OpenClaw.- Wybrany model musi obsługiwać dane wejściowe w postaci obrazów; modele wyłącznie tekstowe mogą odrzucić żądanie po stronie dostawcy.
model run --promptmusi zawierać tekst składający się nie tylko z białych znaków; puste prompty są odrzucane przed wywołaniem dostawcy lub Gateway.- Lokalne
model runkończy działanie kodem różnym od zera, gdy dostawca nie zwróci tekstu, dzięki czemu nieosiągalni dostawcy i puste uzupełnienia nie wyglądają jak udane testy. - Użyj
model run --gateway, aby przetestować trasowanie Gateway lub konfigurację środowiska wykonawczego agenta przy zachowaniu surowych danych wejściowych modelu. Użyjopenclaw agentlub interfejsu czatu, aby uzyskać pełny kontekst agenta, narzędzia, pamięć i transkrypcję sesji. --thinking adaptivejest mapowane na poziom środowiska wykonawczego uzupełnianiamedium;--thinking maxjest mapowane namaxdla modeli OpenAI obsługujących natywny maksymalny nakład rozumowania, a w pozostałych przypadkach naxhigh.model auth login,model auth logoutimodel auth statuszarządzają zapisanym stanem uwierzytelniania dostawcy.
Obraz
Generowanie, edycja i opis.-
Użyj
image edit, gdy zaczynasz od istniejących plików wejściowych;--size,--aspect-ratiolub--resolutiondodają wskazówki dotyczące geometrii w przypadku dostawców/modeli, które je obsługują. -
--output-format png --background transparentz--model openai/gpt-image-1.5generuje za pomocą OpenAI plik PNG z przezroczystym tłem;--openai-backgroundjest specyficznym dla OpenAI aliasem tej samej wskazówki. Dostawcy, którzy nie deklarują obsługi tła, zgłaszają ją jako zignorowane nadpisanie (zobaczignoredOverridesw obiekcie JSON). -
--quality low|medium|high|autodziała z dostawcami obsługującymi wskazówki dotyczące jakości obrazu, w tym z OpenAI. OpenAI akceptuje również--openai-moderation low|auto. -
image providers --jsonwyświetla, którzy dołączani dostawcy obrazów są wykrywalni, skonfigurowani i wybrani oraz jakie możliwości generowania/edycji udostępnia każdy z nich. -
image generate --model <provider/model> --jsonjest najbardziej ukierunkowanym testem dymnym na żywo dla zmian w generowaniu obrazów:Odpowiedź zawieraok,provider,model,attemptsoraz ścieżki zapisanych plików wyjściowych. Gdy ustawiono--output, końcowe rozszerzenie może odpowiadać typowi MIME zwróconemu przez dostawcę. -
W przypadku
image describeiimage describe-manyużyj--prompt, aby przekazać instrukcję dotyczącą konkretnego zadania (OCR, porównanie, inspekcja interfejsu, zwięzły opis). -
Użyj
--timeout-msw przypadku wolnych lokalnych modeli wizyjnych lub zimnego uruchamiania Ollama. -
W przypadku
image describejawnie określony--model(musi to być obsługujący obrazy<provider/model>) jest uruchamiany jako pierwszy, a następnie, jeśli to wywołanie się nie powiedzie, podejmowane są próby użycia skonfigurowanychagents.defaults.imageModel.fallbacks. Błędy przygotowania danych wejściowych (brak pliku, nieobsługiwany adres URL) powodują niepowodzenie przed jakąkolwiek próbą użycia modelu zapasowego, a model musi obsługiwać obrazy w katalogu modeli lub konfiguracji dostawcy. -
W przypadku lokalnych modeli wizyjnych Ollama najpierw pobierz model i ustaw
OLLAMA_API_KEYna dowolną wartość zastępczą, na przykładollama-local. Zobacz Ollama.
Dźwięk
Transkrypcja plików (bez zarządzania sesjami w czasie rzeczywistym).--model musi mieć postać <provider/model>.
TTS
Synteza mowy oraz stan dostawcy/persony TTS.tts statusobsługuje tylko--gateway(odzwierciedla stan TTS zarządzany przez Gateway).- Użyj
tts providers,tts voices,tts personas,tts set-provideritts set-persona, aby sprawdzać i konfigurować działanie TTS.
Wideo
Generowanie i opisywanie.video generateprzyjmuje--size,--aspect-ratio,--resolution,--duration,--audio,--watermarki--timeout-ms, które są przekazywane do środowiska wykonawczego generowania wideo.- W przypadku
video describeparametr--modelmusi mieć postać<provider/model>.
Sieć
Wyszukiwanie i pobieranie.web providers wyświetla dostępnych, skonfigurowanych i wybranych dostawców wyszukiwania i pobierania.
Osadzanie
Tworzenie wektorów i sprawdzanie dostawców osadzania.Dane wyjściowe JSON
Polecenia Infer normalizują dane wyjściowe JSON we wspólnym obiekcie:okcapabilitytransportprovidermodelattemptsinputs(załączniki graficzne wysłane wraz z żądaniem, gdy ma to zastosowanie)outputsignoredOverrides(klucze wskazówek nieobsługiwanych przez dostawcę, gdy ma to zastosowanie)error
outputs zawiera pliki zapisane przez OpenClaw. Do automatyzacji używaj wartości path, mimeType, size oraz wymiarów właściwych dla danego rodzaju multimediów z tej tablicy, zamiast analizować czytelne dla człowieka standardowe dane wyjściowe.