Skip to main content
models.providers.<id>.localService inicia, sob demanda, um servidor local de modelos gerenciado pelo provedor. Quando uma solicitação de modelo ou embeddings seleciona esse provedor, o OpenClaw verifica o endpoint de integridade, inicia o processo se ele estiver inativo, aguarda até que esteja pronto e, então, envia a solicitação. Use esse recurso para evitar manter servidores locais de alto custo em execução o dia todo.

Como funciona

  1. Uma solicitação de modelo ou embeddings é resolvida para um provedor configurado.
  2. Se esse provedor tiver localService, o OpenClaw verifica healthUrl.
  3. Se a verificação for bem-sucedida, o OpenClaw usa o servidor que já está em execução.
  4. Se a verificação falhar, o OpenClaw inicia command com args.
  5. O OpenClaw consulta periodicamente o endpoint de integridade até que readyTimeoutMs expire.
  6. A solicitação segue pelo transporte normal de modelo ou embeddings.
  7. Se o OpenClaw tiver iniciado o processo e idleStopMs estiver definido, ele interromperá o processo quando, após a última solicitação em andamento, tiver transcorrido esse período de inatividade.
O OpenClaw não instala launchd, systemd, Docker nem nenhum daemon para isso. O servidor é simplesmente um processo filho do processo do OpenClaw que primeiro precisou dele. A inicialização é serializada por provedor configurado e conjunto de comando, argumentos e variáveis de ambiente; assim, solicitações simultâneas de chat e embeddings para o mesmo serviço não iniciam servidores duplicados. Cada solicitação mantém sua própria concessão até a conclusão do processamento da resposta, de modo que o desligamento por inatividade aguarda todas as solicitações de modelo e embeddings em andamento. Os aliases de provedor configurados permanecem distintos: dois aliases podem apontar para hosts de GPU diferentes sem serem consolidados no mesmo identificador de adaptador do Ollama, LM Studio ou compatível com OpenAI. Se outro processo do OpenClaw já tiver um servidor íntegro no mesmo healthUrl, este processo o reutilizará sem assumir seu gerenciamento (cada processo gerencia apenas o processo filho que ele próprio iniciou). Os logs de inicialização e encerramento incluem trechos finais limitados e ocultados da saída do processo filho, além de informações de duração e encerramento; os valores de ambiente configurados nunca são exibidos.

Estrutura da configuração

Defina timeoutSeconds na entrada do provedor (não em localService) para que inicializações a frio lentas e gerações longas não atinjam o tempo limite padrão das solicitações de modelo. Defina um healthUrl explícito sempre que o servidor expuser a prontidão em um local diferente de /models na URL base.

Campos

Exemplo com Inferrs

O Inferrs é um backend /v1 personalizado compatível com OpenAI, portanto a mesma API localService funciona com uma entrada de provedor inferrs:
Substitua command pelo resultado de which inferrs na máquina que executa o OpenClaw. Configuração completa do inferrs: Inferrs.

Exemplo com ds4

Comandos completos de configuração, dimensionamento do contexto e verificação: ds4.

Relacionados

Modelos locais

Configuração de modelos locais, opções de provedor e orientações de segurança.

Inferrs

Execute o OpenClaw por meio do servidor local do inferrs compatível com OpenAI.