Skip to main content
models.providers.<id>.localService inicia bajo demanda un servidor de modelos local propiedad del proveedor. Cuando una solicitud de modelo o de embeddings selecciona ese proveedor, OpenClaw comprueba el endpoint de estado, inicia el proceso si no está activo, espera a que esté listo y, después, envía la solicitud. Úselo para evitar mantener en ejecución durante todo el día servidores locales que consumen muchos recursos.

Cómo funciona

  1. Una solicitud de modelo o de embeddings se resuelve en un proveedor configurado.
  2. Si ese proveedor tiene localService, OpenClaw comprueba healthUrl.
  3. Si la comprobación se realiza correctamente, OpenClaw utiliza el servidor que ya está en ejecución.
  4. Si la comprobación falla, OpenClaw inicia command con args.
  5. OpenClaw consulta periódicamente el endpoint de estado hasta que vence readyTimeoutMs.
  6. La solicitud se envía mediante el transporte normal de modelos o embeddings.
  7. Si OpenClaw inició el proceso y se ha definido idleStopMs, detiene el proceso cuando ha transcurrido ese tiempo desde que quedó inactiva la última solicitud en curso.
OpenClaw no instala launchd, systemd, Docker ni ningún daemon para esto. El servidor es un proceso secundario convencional del proceso de OpenClaw que primero lo necesitó. El inicio se serializa por cada combinación de proveedor configurado y comando, argumentos y entorno, por lo que las solicitudes simultáneas de chat y embeddings para el mismo servicio no inician servidores duplicados. Cada solicitud mantiene su propia concesión hasta que finaliza el procesamiento de la respuesta, de modo que el apagado por inactividad espera a que terminen todas las solicitudes de modelos y embeddings en curso. Los alias de proveedores configurados siguen siendo distintos: dos alias pueden apuntar a diferentes hosts con GPU sin agruparse bajo el mismo identificador de adaptador de Ollama, LM Studio o compatible con OpenAI. Si otro proceso de OpenClaw ya tiene un servidor en buen estado en la misma healthUrl, este proceso lo reutiliza sin adoptarlo (cada proceso solo administra el proceso secundario que inició personalmente). Los registros de inicio y salida incluyen fragmentos finales limitados y censurados de la salida del proceso secundario, además de información sobre tiempos y salida; los valores de entorno configurados nunca se muestran.

Estructura de configuración

Defina timeoutSeconds en la entrada del proveedor (no en localService) para que los inicios en frío lentos y las generaciones prolongadas no alcancen el tiempo de espera predeterminado de las solicitudes de modelos. Defina un valor explícito para healthUrl siempre que el servidor exponga el estado de disponibilidad en un lugar distinto de /models en la URL base.

Campos

Ejemplo de Inferrs

Inferrs es un backend /v1 personalizado compatible con OpenAI, por lo que la misma API localService funciona con una entrada de proveedor inferrs:
Sustituya command por el resultado de which inferrs en la máquina donde se ejecuta OpenClaw. Configuración completa de Inferrs: Inferrs.

Ejemplo de ds4

Configuración completa, dimensionamiento del contexto y comandos de verificación: ds4.

Contenido relacionado

Modelos locales

Configuración de modelos locales, opciones de proveedores y recomendaciones de seguridad.

Inferrs

Ejecute OpenClaw mediante el servidor local de Inferrs compatible con OpenAI.