Skip to main content
O Hugging Face Inference Providers disponibiliza um roteador de conclusões de chat compatível com a OpenAI para diversos modelos hospedados (DeepSeek, Llama e outros), usando um único token. O OpenClaw se comunica somente com o endpoint de conclusões de chat; para conversão de texto em imagem, embeddings ou fala, use diretamente os clientes de inferência da HF.

Primeiros passos

1

Create a fine-grained token

Acesse Hugging Face Settings Tokens e crie um novo token de granularidade fina.
O token deve ter a permissão Make calls to Inference Providers habilitada, caso contrário as solicitações à API serão rejeitadas.
2

Run onboarding

Escolha Hugging Face no menu suspenso de provedores e insira sua chave de API quando solicitado:
3

Select a default model

No menu suspenso Modelo padrão do Hugging Face, escolha um modelo. A lista é carregada pela API de inferência quando seu token é válido; caso contrário, o OpenClaw exibe o catálogo integrado abaixo. Sua escolha é salva como agents.defaults.model.primary:
4

Verify the model is available

Configuração não interativa

Define huggingface/deepseek-ai/DeepSeek-R1 como o modelo padrão.

IDs de modelos

As referências de modelos usam o formato huggingface/<org>/<model> (IDs no estilo do Hub). Catálogo integrado do OpenClaw:
Quando seu token é válido, o OpenClaw também descobre qualquer outro modelo por meio de GET https://router.huggingface.co/v1/models durante a integração inicial e a inicialização do Gateway, portanto seu catálogo pode incluir muito mais do que os quatro modelos acima. Você pode acrescentar :fastest ou :cheapest a qualquer ID de modelo; o roteador da HF encaminha a solicitação ao provedor de inferência correspondente. Defina a ordem padrão dos provedores em Inference Provider settings.

Configuração avançada

O OpenClaw descobre modelos com:
A resposta segue o estilo da OpenAI: { "object": "list", "data": [ { "id": "Qwen/Qwen3-8B", "owned_by": "Qwen", ... }, ... ] }.Com uma chave configurada (na integração inicial, em HUGGINGFACE_HUB_TOKEN ou em HF_TOKEN), o menu suspenso Modelo padrão do Hugging Face durante a configuração interativa é preenchido por esse endpoint. A inicialização do Gateway repete a mesma chamada para atualizar o catálogo. Os modelos descobertos são combinados com o catálogo integrado acima (usado para metadados como janela de contexto e custo quando há correspondência de ID). Se a solicitação falhar, não retornar dados ou nenhuma chave estiver definida, o OpenClaw usará somente o catálogo integrado.Desabilite a descoberta sem remover o provedor:
  • Nome da API: os modelos descobertos usam name, title ou display_name da API quando disponíveis; caso contrário, o OpenClaw deriva um nome do ID do modelo (por exemplo, deepseek-ai/DeepSeek-R1 se torna “DeepSeek R1”).
  • Substituir o nome de exibição: defina um rótulo personalizado por modelo na configuração:
  • Sufixos de política: :fastest e :cheapest são convenções do roteador da HF, não algo que o OpenClaw reescreva: o sufixo é enviado literalmente como parte do ID do modelo, e o roteador da HF escolhe o provedor de inferência correspondente. Adicione cada variante como uma entrada própria em models.providers.huggingface.models (ou em model.primary) caso queira um alias diferente para cada sufixo.
  • Mesclagem da configuração: as entradas existentes em models.providers.huggingface.models (por exemplo, em models.json) são mantidas durante a mesclagem da configuração, portanto qualquer name, alias ou opção de modelo personalizada definida ali persiste entre reinicializações.
Se o Gateway for executado como um daemon (launchd/systemd), verifique se HUGGINGFACE_HUB_TOKEN ou HF_TOKEN está disponível para esse processo (por exemplo, em ~/.openclaw/.env ou por meio de env.shellEnv).
O OpenClaw aceita tanto HUGGINGFACE_HUB_TOKEN quanto HF_TOKEN. Se ambos estiverem definidos, HUGGINGFACE_HUB_TOKEN terá precedência.

Relacionados

Model selection

Visão geral de todos os provedores, referências de modelos e comportamento de failover.

Model selection

Como escolher e configurar modelos.

Inference Providers docs

Documentação oficial do Hugging Face Inference Providers.

Configuration

Referência completa de configuração.