/v1 compatibile con OpenAI. OpenClaw comunica con essa tramite l’adattatore generico openai-completions.
inferrs è un backend personalizzato, self-hosted e compatibile con OpenAI, non un Plugin provider dedicato di OpenClaw: va configurato in models.providers.inferrs invece di selezionare un’opzione di autenticazione durante la configurazione iniziale. Per un Plugin incluso con rilevamento automatico, consultare SGLang o vLLM.Guida introduttiva
1
Avviare inferrs con un modello
2
Verificare che il server sia raggiungibile
3
Aggiungere una voce provider di OpenClaw
Aggiungere una voce esplicita per il provider e impostarla come destinazione del modello predefinito. Consultare l’esempio di configurazione seguente.
Esempio di configurazione completa
Gemma 4 su un serverinferrs locale:
Avvio su richiesta
OpenClaw può avviare autonomamenteinferrs solo quando viene selezionato un modello inferrs/.... Aggiungere localService alla stessa voce del provider:
command deve essere un percorso assoluto. Eseguire which inferrs sull’host del Gateway e utilizzare il percorso restituito. Riferimento completo dei campi: Servizi per modelli locali.
Configurazione avanzata
Perché requiresStringContent è importante
Perché requiresStringContent è importante
Alcune route Chat Completions di
inferrs accettano solo valori stringa in messages[].content, non array strutturati di parti del contenuto.Avvertenza su Gemma e sullo schema degli strumenti
Avvertenza su Gemma e sullo schema degli strumenti
Alcune combinazioni di Ciò riduce il carico del prompt sui backend locali più restrittivi. Se le piccole richieste dirette continuano a funzionare, ma i normali turni dell’agente OpenClaw continuano a causare arresti anomali in
inferrs e Gemma accettano piccole richieste dirette a /v1/chat/completions, ma non riescono a gestire turni completi del runtime dell’agente OpenClaw. Provare innanzitutto a disabilitare lo schema degli strumenti:inferrs, considerare il problema una limitazione a monte del modello o del server, anziché un problema del trasporto di OpenClaw.Test rapido manuale
Test rapido manuale
Una volta completata la configurazione, verificare entrambi i livelli:Se il primo comando funziona ma il secondo non riesce, consultare la sezione Risoluzione dei problemi seguente.
Comportamento in stile proxy
Comportamento in stile proxy
Poiché
inferrs utilizza l’adattatore generico openai-completions (non openai-responses), non viene mai applicata la formattazione delle richieste specifica delle API native di OpenAI: non vengono inviati service_tier, il campo store dell’API Responses, suggerimenti per la cache dei prompt né payload di compatibilità per il ragionamento di OpenAI.Risoluzione dei problemi
curl /v1/models non riesce
curl /v1/models non riesce
inferrs non è in esecuzione, non è raggiungibile oppure non è associato all’host o alla porta configurati. Verificare che il server sia avviato e in ascolto su tale indirizzo.messages[].content richiede una stringa
messages[].content richiede una stringa
Impostare
compat.requiresStringContent: true nella voce del modello (vedere sopra).Le chiamate dirette a /v1/chat/completions riescono, ma openclaw infer model run non funziona
Le chiamate dirette a /v1/chat/completions riescono, ma openclaw infer model run non funziona
Impostare
compat.supportsTools: false per disabilitare lo schema degli strumenti (consultare l’avvertenza su Gemma riportata sopra).inferrs continua a bloccarsi nei turni più grandi dell'agente
inferrs continua a bloccarsi nei turni più grandi dell'agente
Se gli errori dello schema sono stati risolti, ma
inferrs continua a bloccarsi nei turni più grandi dell’agente, considerare il problema una limitazione a monte di inferrs o del modello. Ridurre il carico del prompt oppure cambiare backend o modello.Contenuti correlati
Modelli locali
Esecuzione di OpenClaw con server di modelli locali.
Servizi per modelli locali
Avvio su richiesta dei server di modelli locali per i provider configurati.
Risoluzione dei problemi del Gateway
Diagnosi dei backend locali compatibili con OpenAI che superano le verifiche ma non riescono a eseguire i turni degli agenti.
Selezione del modello
Panoramica di tutti i provider, dei riferimenti ai modelli e del comportamento di failover.