/v1 compatibile con OpenAI. OpenClaw si connette a ds4
tramite la famiglia di provider generica openai-completions.
ds4 non è un Plugin provider incluso in OpenClaw. Configuralo in
models.providers.ds4, quindi seleziona ds4/deepseek-v4-flash.
Requisiti
- macOS con supporto Metal.
- Un checkout ds4 funzionante con
ds4-servere il file GGUF di DeepSeek V4 Flash. - Memoria sufficiente per il contesto scelto; valori
--ctxmaggiori allocano più memoria KV all’avvio del server.
Avvio rapido
1
Start ds4-server
Sostituisci
<DS4_DIR> con il percorso del checkout ds4.2
Verify the OpenAI-compatible endpoint
deepseek-v4-flash.3
Add the OpenClaw provider config
Aggiungi la configurazione indicata in Configurazione completa, quindi esegui un controllo
singolo del modello:
Configurazione completa
Usa questa configurazione quando ds4 è già in esecuzione su127.0.0.1:18000.
contextWindow allineato con ds4-server --ctx. Mantieni maxTokens allineato
con --tokens, a meno che tu non voglia intenzionalmente che OpenClaw richieda un output inferiore
rispetto al valore predefinito del server.
Avvio su richiesta
OpenClaw può avviare ds4 solo quando viene selezionato un modellods4/.... Aggiungi
localService alla stessa voce del provider:
command deve essere un percorso assoluto a un eseguibile. La ricerca tramite shell e l’espansione di ~
non vengono utilizzate. Consulta Servizi per modelli locali per
tutti i campi di localService.
Think Max
ds4 applica Think Max solo quando entrambe le condizioni sono vere:ds4-serverviene avviato con--ctx 393216o un valore superiore.- La richiesta usa
reasoning_effort: "max"(o il campo equivalente di ds4 per il livello di ragionamento).
Test
Controllo HTTP diretto, senza passare da OpenClaw:executionTrace.winnerProviderèds4executionTrace.winnerModelèdeepseek-v4-flashtoolSummary.callsè almeno1finalAssistantVisibleTextinizia contool-ok
Risoluzione dei problemi
curl /v1/models cannot connect
curl /v1/models cannot connect
ds4 non è in esecuzione oppure non è associato all’host o alla porta indicati in
baseUrl. Avvia
ds4-server, quindi riprova:500 prompt exceeds context
500 prompt exceeds context
Il valore
--ctx configurato è troppo piccolo per il turno di OpenClaw. Aumenta
ds4-server --ctx, quindi aggiorna models.providers.ds4.models[].contextWindow
in modo che corrisponda. I turni completi dell’agente con gli strumenti richiedono molto più contesto rispetto a una
richiesta curl diretta con un singolo messaggio.Think Max does not activate
Think Max does not activate
ds4 usa Think Max solo quando
--ctx è almeno 393216 e la richiesta
specifica reasoning_effort: "max". Con contesti più piccoli viene usato il livello di ragionamento
alto.The first request is slow
The first request is slow
ds4 presenta una fase iniziale di caricamento a freddo in Metal e di riscaldamento del modello. Imposta
localService.readyTimeoutMs: 300000 quando OpenClaw avvia il server su
richiesta.Contenuti correlati
Local model services
Avvia i server dei modelli locali su richiesta prima delle richieste ai modelli.
Local models
Scegli e gestisci i backend dei modelli locali.
Model providers
Configura i riferimenti ai provider, l’autenticazione e il failover.
DeepSeek
Comportamento nativo del provider DeepSeek e controlli del ragionamento.