Skip to main content
ds4 biedt DeepSeek V4 Flash aan vanuit een lokale Metal-backend met een OpenAI-compatibele /v1-API. OpenClaw maakt verbinding met ds4 via de generieke providerfamilie openai-completions. ds4 is geen gebundelde OpenClaw-providerplugin. Configureer deze onder models.providers.ds4 en selecteer vervolgens ds4/deepseek-v4-flash.

Vereisten

  • macOS met Metal-ondersteuning.
  • Een werkende ds4-check-out met ds4-server en het GGUF-bestand van DeepSeek V4 Flash.
  • Voldoende geheugen voor de gekozen context; grotere waarden voor --ctx wijzen bij het opstarten van de server meer KV-geheugen toe.
OpenClaw-agentbeurten bevatten toolschema’s en werkruimtecontext. Een kleine context zoals --ctx 4096 kan directe curl-tests doorstaan, maar volledige agentuitvoeringen laten mislukken met 500 prompt exceeds context. Gebruik voor rooktests van agents en tools ten minste --ctx 32768. Gebruik --ctx 393216 alleen met voldoende geheugen en om ds4 Think Max in te schakelen.

Snelstart

1

Start ds4-server

Vervang <DS4_DIR> door het pad naar je ds4-check-out.
2

Controleer het OpenAI-compatibele eindpunt

Het antwoord moet deepseek-v4-flash bevatten.
3

Voeg de OpenClaw-providerconfiguratie toe

Voeg de configuratie uit Volledige configuratie toe en voer vervolgens een eenmalige modelcontrole uit:

Volledige configuratie

Gebruik deze configuratie wanneer ds4 al op 127.0.0.1:18000 wordt uitgevoerd.
Houd contextWindow afgestemd op ds4-server --ctx. Houd maxTokens afgestemd op --tokens, tenzij je bewust wilt dat OpenClaw minder uitvoer aanvraagt dan de standaardwaarde van de server.

Op aanvraag starten

OpenClaw kan ds4 alleen starten wanneer een ds4/...-model is geselecteerd. Voeg localService toe aan dezelfde providervermelding:
command moet een absoluut pad naar een uitvoerbaar bestand zijn. Shellopzoeking en uitbreiding van ~ worden niet gebruikt. Zie Lokale modelservices voor elk localService-veld.

Think Max

ds4 past Think Max alleen toe wanneer aan beide voorwaarden wordt voldaan:
  • ds4-server start met --ctx 393216 of hoger.
  • De aanvraag gebruikt reasoning_effort: "max" (of het equivalente ds4-inspanningsveld).
Als je die grote context gebruikt, werk dan zowel de servervlaggen als de OpenClaw-modelmetadata bij:

Test

Directe HTTP-controle, waarbij OpenClaw wordt omzeild:
OpenClaw-modelroutering (hetzelfde als de controle in Snelstart):
Volledige rooktest voor agent- en toolaanroepen, met een context van ten minste 32768:
Verwacht resultaat:
  • executionTrace.winnerProvider is ds4
  • executionTrace.winnerModel is deepseek-v4-flash
  • toolSummary.calls is ten minste 1
  • finalAssistantVisibleText begint met tool-ok

Problemen oplossen

ds4 wordt niet uitgevoerd of is niet gebonden aan de host/poort in baseUrl. Start ds4-server en probeer het opnieuw:
De geconfigureerde --ctx is te klein voor de OpenClaw-beurt. Verhoog ds4-server --ctx en werk vervolgens models.providers.ds4.models[].contextWindow bij zodat deze overeenkomt. Volledige agentbeurten met tools hebben aanzienlijk meer context nodig dan een directe curl-aanvraag met één bericht.
ds4 gebruikt Think Max alleen wanneer --ctx ten minste 393216 is en de aanvraag om reasoning_effort: "max" vraagt. Kleinere contexten vallen terug op een hoog redeneerniveau.
ds4 heeft een koude Metal-residentie en een opwarmfase voor het model. Stel localService.readyTimeoutMs: 300000 in wanneer OpenClaw de server op aanvraag start.

Gerelateerd

Lokale modelservices

Start lokale modelservers op aanvraag vóór modelaanvragen.

Lokale modellen

Kies en beheer lokale modelbackends.

Modelproviders

Configureer providerverwijzingen, authenticatie en failover.

DeepSeek

Gedrag van de native DeepSeek-provider en bedieningselementen voor denken.