/v1 compatible con OpenAI. OpenClaw se conecta a ds4
mediante la familia de proveedores genérica openai-completions.
ds4 no es un plugin de proveedor incluido con OpenClaw. Configúrelo en
models.providers.ds4 y, a continuación, seleccione ds4/deepseek-v4-flash.
Requisitos
- macOS con compatibilidad con Metal.
- Una copia de trabajo de ds4 con
ds4-servery el archivo GGUF de DeepSeek V4 Flash. - Memoria suficiente para el contexto elegido; los valores de
--ctxmás grandes asignan más memoria KV al iniciar el servidor.
Inicio rápido
1
Iniciar ds4-server
Sustituya
<DS4_DIR> por la ruta de la copia de trabajo de ds4.2
Verificar el endpoint compatible con OpenAI
deepseek-v4-flash.3
Añadir la configuración del proveedor de OpenClaw
Añada la configuración de Configuración completa y, a continuación, ejecute una comprobación
puntual del modelo:
Configuración completa
Use esta configuración cuando ds4 ya se esté ejecutando en127.0.0.1:18000.
contextWindow alineado con ds4-server --ctx. Mantenga maxTokens alineado
con --tokens, salvo que se quiera que OpenClaw solicite intencionadamente menos salida
que el valor predeterminado del servidor.
Inicio bajo demanda
OpenClaw puede iniciar ds4 solo cuando se selecciona un modelods4/.... Añada
localService a la misma entrada del proveedor:
command debe ser una ruta absoluta a un ejecutable. No se utilizan la búsqueda del shell ni la expansión de
~. Consulte Servicios de modelos locales para conocer
todos los campos de localService.
Think Max
ds4 aplica Think Max solo cuando se cumplen ambas condiciones:ds4-servercomienza con--ctx 393216o un valor superior.- La solicitud usa
reasoning_effort: "max"(o el campo de esfuerzo equivalente de ds4).
Prueba
Comprobación HTTP directa, sin pasar por OpenClaw:executionTrace.winnerProvideresds4executionTrace.winnerModelesdeepseek-v4-flashtoolSummary.callses al menos1finalAssistantVisibleTextcomienza contool-ok
Solución de problemas
curl /v1/models no puede conectarse
curl /v1/models no puede conectarse
ds4 no se está ejecutando o no está vinculado al host/puerto de
baseUrl. Inicie
ds4-server y vuelva a intentarlo:500: el prompt supera el contexto
500: el prompt supera el contexto
El valor configurado de
--ctx es demasiado pequeño para el turno de OpenClaw. Aumente
ds4-server --ctx y, a continuación, actualice models.providers.ds4.models[].contextWindow
para que coincida. Los turnos completos del agente con herramientas necesitan bastante más contexto que una
solicitud directa de curl con un solo mensaje.Think Max no se activa
Think Max no se activa
ds4 solo usa Think Max cuando
--ctx es al menos 393216 y la solicitud
pide reasoning_effort: "max". Los contextos más pequeños recurren al razonamiento
alto.La primera solicitud es lenta
La primera solicitud es lenta
ds4 tiene una fase inicial de carga en Metal y calentamiento del modelo. Configure
localService.readyTimeoutMs: 300000 cuando OpenClaw inicie el servidor
bajo demanda.Relacionado
Servicios de modelos locales
Inicie servidores de modelos locales bajo demanda antes de las solicitudes al modelo.
Modelos locales
Elija y opere backends de modelos locales.
Proveedores de modelos
Configure referencias de proveedores, autenticación y conmutación por error.
DeepSeek
Comportamiento nativo del proveedor DeepSeek y controles de pensamiento.