Skip to main content
ds4 sirve DeepSeek V4 Flash desde un backend Metal local con una API /v1 compatible con OpenAI. OpenClaw se conecta a ds4 mediante la familia de proveedores genérica openai-completions. ds4 no es un plugin de proveedor incluido con OpenClaw. Configúrelo en models.providers.ds4 y, a continuación, seleccione ds4/deepseek-v4-flash.

Requisitos

  • macOS con compatibilidad con Metal.
  • Una copia de trabajo de ds4 con ds4-server y el archivo GGUF de DeepSeek V4 Flash.
  • Memoria suficiente para el contexto elegido; los valores de --ctx más grandes asignan más memoria KV al iniciar el servidor.
Los turnos del agente de OpenClaw incluyen esquemas de herramientas y contexto del espacio de trabajo. Un contexto pequeño como --ctx 4096 puede superar las pruebas directas con curl, pero fallar en ejecuciones completas del agente con 500 prompt exceeds context. Use al menos --ctx 32768 para las pruebas de humo del agente y las herramientas. Use --ctx 393216 solo si dispone de memoria suficiente y para habilitar Think Max de ds4.

Inicio rápido

1

Iniciar ds4-server

Sustituya <DS4_DIR> por la ruta de la copia de trabajo de ds4.
2

Verificar el endpoint compatible con OpenAI

La respuesta debe incluir deepseek-v4-flash.
3

Añadir la configuración del proveedor de OpenClaw

Añada la configuración de Configuración completa y, a continuación, ejecute una comprobación puntual del modelo:

Configuración completa

Use esta configuración cuando ds4 ya se esté ejecutando en 127.0.0.1:18000.
Mantenga contextWindow alineado con ds4-server --ctx. Mantenga maxTokens alineado con --tokens, salvo que se quiera que OpenClaw solicite intencionadamente menos salida que el valor predeterminado del servidor.

Inicio bajo demanda

OpenClaw puede iniciar ds4 solo cuando se selecciona un modelo ds4/.... Añada localService a la misma entrada del proveedor:
command debe ser una ruta absoluta a un ejecutable. No se utilizan la búsqueda del shell ni la expansión de ~. Consulte Servicios de modelos locales para conocer todos los campos de localService.

Think Max

ds4 aplica Think Max solo cuando se cumplen ambas condiciones:
  • ds4-server comienza con --ctx 393216 o un valor superior.
  • La solicitud usa reasoning_effort: "max" (o el campo de esfuerzo equivalente de ds4).
Si se ejecuta ese contexto de gran tamaño, actualice tanto las opciones del servidor como los metadatos del modelo de OpenClaw:

Prueba

Comprobación HTTP directa, sin pasar por OpenClaw:
Enrutamiento del modelo de OpenClaw (igual que la comprobación del inicio rápido):
Prueba de humo completa del agente y de las llamadas a herramientas, con un contexto de al menos 32768:
Resultado esperado:
  • executionTrace.winnerProvider es ds4
  • executionTrace.winnerModel es deepseek-v4-flash
  • toolSummary.calls es al menos 1
  • finalAssistantVisibleText comienza con tool-ok

Solución de problemas

ds4 no se está ejecutando o no está vinculado al host/puerto de baseUrl. Inicie ds4-server y vuelva a intentarlo:
El valor configurado de --ctx es demasiado pequeño para el turno de OpenClaw. Aumente ds4-server --ctx y, a continuación, actualice models.providers.ds4.models[].contextWindow para que coincida. Los turnos completos del agente con herramientas necesitan bastante más contexto que una solicitud directa de curl con un solo mensaje.
ds4 solo usa Think Max cuando --ctx es al menos 393216 y la solicitud pide reasoning_effort: "max". Los contextos más pequeños recurren al razonamiento alto.
ds4 tiene una fase inicial de carga en Metal y calentamiento del modelo. Configure localService.readyTimeoutMs: 300000 cuando OpenClaw inicie el servidor bajo demanda.

Relacionado

Servicios de modelos locales

Inicie servidores de modelos locales bajo demanda antes de las solicitudes al modelo.

Modelos locales

Elija y opere backends de modelos locales.

Proveedores de modelos

Configure referencias de proveedores, autenticación y conmutación por error.

DeepSeek

Comportamiento nativo del proveedor DeepSeek y controles de pensamiento.