Skip to main content
inferrs espone modelli locali tramite un’API /v1 compatibile con OpenAI. OpenClaw comunica con essa tramite l’adattatore generico openai-completions.
inferrs è un backend personalizzato, self-hosted e compatibile con OpenAI, non un Plugin provider dedicato di OpenClaw: va configurato in models.providers.inferrs invece di selezionare un’opzione di autenticazione durante la configurazione iniziale. Per un Plugin incluso con rilevamento automatico, consultare SGLang o vLLM.

Guida introduttiva

1

Avviare inferrs con un modello

2

Verificare che il server sia raggiungibile

3

Aggiungere una voce provider di OpenClaw

Aggiungere una voce esplicita per il provider e impostarla come destinazione del modello predefinito. Consultare l’esempio di configurazione seguente.

Esempio di configurazione completa

Gemma 4 su un server inferrs locale:

Avvio su richiesta

OpenClaw può avviare autonomamente inferrs solo quando viene selezionato un modello inferrs/.... Aggiungere localService alla stessa voce del provider:
command deve essere un percorso assoluto. Eseguire which inferrs sull’host del Gateway e utilizzare il percorso restituito. Riferimento completo dei campi: Servizi per modelli locali.

Configurazione avanzata

Alcune route Chat Completions di inferrs accettano solo valori stringa in messages[].content, non array strutturati di parti del contenuto.
Se le esecuzioni di OpenClaw non riescono e mostrano:
impostare compat.requiresStringContent: true nella voce del modello. OpenClaw convertirà quindi le parti contenenti solo testo in semplici stringhe prima di inviare la richiesta.
Alcune combinazioni di inferrs e Gemma accettano piccole richieste dirette a /v1/chat/completions, ma non riescono a gestire turni completi del runtime dell’agente OpenClaw. Provare innanzitutto a disabilitare lo schema degli strumenti:
Ciò riduce il carico del prompt sui backend locali più restrittivi. Se le piccole richieste dirette continuano a funzionare, ma i normali turni dell’agente OpenClaw continuano a causare arresti anomali in inferrs, considerare il problema una limitazione a monte del modello o del server, anziché un problema del trasporto di OpenClaw.
Una volta completata la configurazione, verificare entrambi i livelli:
Se il primo comando funziona ma il secondo non riesce, consultare la sezione Risoluzione dei problemi seguente.
Poiché inferrs utilizza l’adattatore generico openai-completions (non openai-responses), non viene mai applicata la formattazione delle richieste specifica delle API native di OpenAI: non vengono inviati service_tier, il campo store dell’API Responses, suggerimenti per la cache dei prompt né payload di compatibilità per il ragionamento di OpenAI.

Risoluzione dei problemi

inferrs non è in esecuzione, non è raggiungibile oppure non è associato all’host o alla porta configurati. Verificare che il server sia avviato e in ascolto su tale indirizzo.
Impostare compat.requiresStringContent: true nella voce del modello (vedere sopra).
Impostare compat.supportsTools: false per disabilitare lo schema degli strumenti (consultare l’avvertenza su Gemma riportata sopra).
Se gli errori dello schema sono stati risolti, ma inferrs continua a bloccarsi nei turni più grandi dell’agente, considerare il problema una limitazione a monte di inferrs o del modello. Ridurre il carico del prompt oppure cambiare backend o modello.
Per assistenza generale, consultare Risoluzione dei problemi e Domande frequenti.

Contenuti correlati

Modelli locali

Esecuzione di OpenClaw con server di modelli locali.

Servizi per modelli locali

Avvio su richiesta dei server di modelli locali per i provider configurati.

Risoluzione dei problemi del Gateway

Diagnosi dei backend locali compatibili con OpenAI che superano le verifiche ma non riescono a eseguire i turni degli agenti.

Selezione del modello

Panoramica di tutti i provider, dei riferimenti ai modelli e del comportamento di failover.