Skip to main content
inferrs sirve modelos locales mediante una API /v1 compatible con OpenAI. OpenClaw se comunica con él a través del adaptador genérico openai-completions.
inferrs es un backend personalizado, autoalojado y compatible con OpenAI, no un plugin de proveedor dedicado de OpenClaw: se configura en models.providers.inferrs en lugar de elegir una opción de autenticación durante la incorporación. Para usar un plugin incluido con detección automática, consulte SGLang o vLLM.

Primeros pasos

1

Iniciar inferrs con un modelo

2

Verificar que se pueda acceder al servidor

3

Añadir una entrada de proveedor de OpenClaw

Añada una entrada de proveedor explícita y dirija el modelo predeterminado a ella. Consulte el ejemplo de configuración siguiente.

Ejemplo de configuración completa

Gemma 4 en un servidor inferrs local:

Inicio bajo demanda

OpenClaw puede iniciar inferrs por sí mismo únicamente cuando se selecciona un modelo inferrs/.... Añada localService a la misma entrada de proveedor:
command debe ser una ruta absoluta. Ejecute which inferrs en el host del Gateway y utilice esa ruta. Referencia completa de los campos: Servicios de modelos locales.

Configuración avanzada

Algunas rutas de Chat Completions de inferrs solo aceptan messages[].content de tipo cadena, no matrices estructuradas de partes de contenido.
Si las ejecuciones de OpenClaw fallan con:
establezca compat.requiresStringContent: true en la entrada del modelo. OpenClaw convierte entonces las partes que contienen únicamente texto en cadenas simples antes de enviar la solicitud.
Algunas combinaciones de inferrs y Gemma aceptan solicitudes directas pequeñas de /v1/chat/completions, pero fallan en turnos completos del entorno de ejecución de agentes de OpenClaw. Pruebe primero a desactivar la superficie del esquema de herramientas:
Esto reduce la presión del prompt sobre los backends locales más estrictos. Si las solicitudes directas pequeñas siguen funcionando, pero los turnos normales de agentes de OpenClaw continúan bloqueándose dentro de inferrs, considérelo una limitación del modelo o servidor ascendente, no un problema del transporte de OpenClaw.
Pruebe ambas capas después de configurarlas:
Si el primer comando funciona, pero el segundo falla, consulte Solución de problemas más adelante.
Debido a que inferrs utiliza el adaptador genérico openai-completions (no openai-responses), nunca se aplica la conformación de solicitudes exclusiva de OpenAI nativo: no se envían service_tier, store de Responses, indicaciones de caché de prompts ni conformación de cargas útiles de compatibilidad de razonamiento de OpenAI.

Solución de problemas

inferrs no se está ejecutando, no es accesible o no está vinculado al host o puerto configurado. Confirme que el servidor esté iniciado y escuchando en esa dirección.
Establezca compat.requiresStringContent: true en la entrada del modelo (consulte la sección anterior).
Establezca compat.supportsTools: false para desactivar la superficie del esquema de herramientas (consulte la advertencia sobre Gemma anterior).
Si los errores de esquema han desaparecido, pero inferrs sigue bloqueándose en turnos de agente más grandes, considérelo una limitación de inferrs ascendente o del modelo. Reduzca la presión del prompt o cambie de backend o modelo.
Para obtener ayuda general, consulte Solución de problemas y Preguntas frecuentes.

Relacionado

Modelos locales

Ejecución de OpenClaw con servidores de modelos locales.

Servicios de modelos locales

Inicio bajo demanda de servidores de modelos locales para los proveedores configurados.

Solución de problemas del Gateway

Depuración de backends locales compatibles con OpenAI que superan las pruebas, pero fallan en las ejecuciones de agentes.

Selección de modelos

Descripción general de todos los proveedores, las referencias de modelos y el comportamiento de conmutación por error.