Skip to main content
Hugging Face Inference Providers espone un router per completamenti chat compatibile con OpenAI davanti a numerosi modelli ospitati (DeepSeek, Llama e altri), accessibili con un unico token. OpenClaw comunica esclusivamente con l’endpoint dei completamenti chat; per la conversione da testo a immagine, gli embedding o la sintesi vocale, usa direttamente i client di inferenza HF.

Per iniziare

1

Crea un token granulare

Vai a Hugging Face Settings Tokens e crea un nuovo token granulare.
Il token deve avere abilitata l’autorizzazione Make calls to Inference Providers, altrimenti le richieste API verranno rifiutate.
2

Esegui la configurazione iniziale

Scegli Hugging Face nell’elenco a discesa dei provider, quindi inserisci la chiave API quando richiesto:
3

Seleziona un modello predefinito

Nell’elenco a discesa Default Hugging Face model, scegli un modello. L’elenco viene caricato dall’Inference API quando il token è valido; in caso contrario, OpenClaw mostra il catalogo integrato riportato di seguito. La scelta viene salvata come agents.defaults.model.primary:
4

Verifica che il modello sia disponibile

Configurazione non interattiva

Imposta huggingface/deepseek-ai/DeepSeek-R1 come modello predefinito.

ID dei modelli

I riferimenti ai modelli usano il formato huggingface/<org>/<model> (ID in stile Hub). Catalogo integrato di OpenClaw:
Quando il token è valido, durante la configurazione iniziale e all’avvio del Gateway OpenClaw rileva anche qualsiasi altro modello tramite GET https://router.huggingface.co/v1/models, perciò il catalogo può includere molti più modelli dei quattro elencati sopra. Puoi aggiungere :fastest o :cheapest a qualsiasi ID modello; il router di HF instrada la richiesta verso il provider di inferenza corrispondente. Imposta l’ordine predefinito dei provider nelle impostazioni dei provider di inferenza.

Configurazione avanzata

OpenClaw rileva i modelli tramite:
La risposta segue il formato di OpenAI: { "object": "list", "data": [ { "id": "Qwen/Qwen3-8B", "owned_by": "Qwen", ... }, ... ] }.Con una chiave configurata (tramite la configurazione iniziale, HUGGINGFACE_HUB_TOKEN o HF_TOKEN), l’elenco a discesa Default Hugging Face model durante la configurazione interattiva viene popolato da questo endpoint. All’avvio, il Gateway ripete la stessa chiamata per aggiornare il catalogo. I modelli rilevati vengono uniti al catalogo integrato riportato sopra, usato per metadati quali la finestra di contesto e il costo quando un ID corrisponde. Se la richiesta non riesce, non restituisce dati o non è impostata alcuna chiave, OpenClaw utilizza esclusivamente il catalogo integrato.Disabilita il rilevamento senza rimuovere il provider:
  • Nome dall’API: i modelli rilevati usano il valore name, title o display_name dell’API quando presente; altrimenti OpenClaw ricava un nome dall’ID modello (ad esempio, deepseek-ai/DeepSeek-R1 diventa “DeepSeek R1”).
  • Sostituzione del nome visualizzato: imposta un’etichetta personalizzata per ciascun modello nella configurazione:
  • Suffissi dei criteri: :fastest e :cheapest sono convenzioni del router HF e non vengono riscritti da OpenClaw: il suffisso viene inviato invariato come parte dell’ID modello e il router HF sceglie il provider di inferenza corrispondente. Aggiungi ogni variante come voce distinta in models.providers.huggingface.models (o in model.primary) se desideri un alias diverso per ciascun suffisso.
  • Unione della configurazione: le voci esistenti in models.providers.huggingface.models (ad esempio in models.json) vengono mantenute durante l’unione della configurazione, quindi qualsiasi valore personalizzato di name, alias o qualsiasi opzione del modello impostata in quella posizione persiste tra i riavvii.
Se il Gateway viene eseguito come daemon (launchd/systemd), assicurati che HUGGINGFACE_HUB_TOKEN o HF_TOKEN sia disponibile per tale processo, ad esempio in ~/.openclaw/.env o tramite env.shellEnv.
OpenClaw accetta sia HUGGINGFACE_HUB_TOKEN sia HF_TOKEN. Se sono impostati entrambi, HUGGINGFACE_HUB_TOKEN ha la precedenza.

Contenuti correlati

Selezione del modello

Panoramica di tutti i provider, dei riferimenti ai modelli e del comportamento di failover.

Selezione del modello

Come scegliere e configurare i modelli.

Documentazione di Inference Providers

Documentazione ufficiale di Hugging Face Inference Providers.

Configurazione

Riferimento completo della configurazione.