Skip to main content
ds4 disponibiliza o DeepSeek V4 Flash por meio de um backend Metal local com uma API /v1 compatível com OpenAI. O OpenClaw se conecta ao ds4 por meio da família genérica de provedores openai-completions. O ds4 não é um Plugin de provedor integrado ao OpenClaw. Configure-o em models.providers.ds4 e selecione ds4/deepseek-v4-flash.

Requisitos

  • macOS com suporte ao Metal.
  • Um checkout funcional do ds4 com ds4-server e o arquivo GGUF do DeepSeek V4 Flash.
  • Memória suficiente para o contexto escolhido; valores maiores de --ctx alocam mais memória KV na inicialização do servidor.
As interações do agente OpenClaw incluem esquemas de ferramentas e o contexto do espaço de trabalho. Um contexto pequeno, como --ctx 4096, pode passar em testes diretos com curl, mas falhar em execuções completas do agente com 500 prompt exceeds context. Use pelo menos --ctx 32768 para testes rápidos do agente e das ferramentas. Use --ctx 393216 somente com memória suficiente e para habilitar o Think Max do ds4.

Início rápido

1

Start ds4-server

Substitua <DS4_DIR> pelo caminho do seu checkout do ds4.
2

Verify the OpenAI-compatible endpoint

A resposta deve incluir deepseek-v4-flash.
3

Add the OpenClaw provider config

Adicione a configuração de Configuração completa e execute uma verificação pontual do modelo:

Configuração completa

Use esta configuração quando o ds4 já estiver em execução em 127.0.0.1:18000.
Mantenha contextWindow alinhado com ds4-server --ctx. Mantenha maxTokens alinhado com --tokens, a menos que você queira intencionalmente que o OpenClaw solicite menos saída do que o padrão do servidor.

Inicialização sob demanda

O OpenClaw pode iniciar o ds4 somente quando um modelo ds4/... for selecionado. Adicione localService à mesma entrada do provedor:
command deve ser um caminho absoluto para um executável. A pesquisa no shell e a expansão de ~ não são usadas. Consulte Serviços de modelos locais para conhecer todos os campos de localService.

Think Max

O ds4 aplica o Think Max somente quando ambas as condições são verdadeiras:
  • O ds4-server é iniciado com --ctx 393216 ou um valor maior.
  • A solicitação usa reasoning_effort: "max" (ou o campo de esforço equivalente do ds4).
Se você executar com esse contexto grande, atualize tanto os sinalizadores do servidor quanto os metadados do modelo no OpenClaw:

Teste

Verificação HTTP direta, ignorando o OpenClaw:
Roteamento de modelo do OpenClaw (igual à verificação do início rápido):
Teste rápido completo do agente e das chamadas de ferramentas, com contexto de pelo menos 32768:
Resultado esperado:
  • executionTrace.winnerProvider é ds4
  • executionTrace.winnerModel é deepseek-v4-flash
  • toolSummary.calls é pelo menos 1
  • finalAssistantVisibleText começa com tool-ok

Solução de problemas

O ds4 não está em execução ou não está vinculado ao host/à porta em baseUrl. Inicie o ds4-server e tente novamente:
O --ctx configurado é pequeno demais para a interação do OpenClaw. Aumente ds4-server --ctx e atualize models.providers.ds4.models[].contextWindow para corresponder. Interações completas do agente com ferramentas precisam de muito mais contexto do que uma solicitação direta de uma única mensagem com curl.
O ds4 usa o Think Max somente quando --ctx é de pelo menos 393216 e a solicitação pede reasoning_effort: "max". Contextos menores recorrem ao nível alto de raciocínio.
O ds4 passa por uma fase inicial de residência a frio no Metal e aquecimento do modelo. Defina localService.readyTimeoutMs: 300000 quando o OpenClaw iniciar o servidor sob demanda.

Relacionados

Local model services

Inicie servidores de modelos locais sob demanda antes das solicitações de modelo.

Local models

Escolha e opere backends de modelos locais.

Model providers

Configure referências de provedores, autenticação e failover.

DeepSeek

Comportamento nativo do provedor DeepSeek e controles de raciocínio.