Skip to main content
ds4 stellt DeepSeek V4 Flash über ein lokales Metal-Backend mit einer OpenAI-kompatiblen /v1-API bereit. OpenClaw verbindet sich mit ds4 über die generische openai-completions-Provider-Familie. ds4 ist kein mitgeliefertes OpenClaw-Provider-Plugin. Konfigurieren Sie es unter models.providers.ds4 und wählen Sie anschließend ds4/deepseek-v4-flash aus.

Anforderungen

  • macOS mit Metal-Unterstützung.
  • Ein funktionsfähiger ds4-Checkout mit ds4-server und der GGUF-Datei für DeepSeek V4 Flash.
  • Ausreichend Arbeitsspeicher für den gewählten Kontext; größere --ctx-Werte weisen beim Serverstart mehr KV-Speicher zu.
OpenClaw-Agent-Durchläufe enthalten Tool-Schemas und Arbeitsbereichskontext. Ein kleiner Kontext wie --ctx 4096 kann direkte curl-Tests bestehen, aber vollständige Agent-Durchläufe mit 500 prompt exceeds context können fehlschlagen. Verwenden Sie mindestens --ctx 32768 für Smoke-Tests von Agent und Tools. Verwenden Sie --ctx 393216 nur bei ausreichendem Arbeitsspeicher und um ds4 Think Max zu aktivieren.

Schnellstart

1

ds4-server starten

Ersetzen Sie <DS4_DIR> durch den Pfad zu Ihrem ds4-Checkout.
2

OpenAI-kompatiblen Endpunkt überprüfen

Die Antwort sollte deepseek-v4-flash enthalten.
3

OpenClaw-Provider-Konfiguration hinzufügen

Fügen Sie die Konfiguration aus Vollständige Konfiguration hinzu und führen Sie anschließend eine einmalige Modellprüfung aus:

Vollständige Konfiguration

Verwenden Sie diese Konfiguration, wenn ds4 bereits unter 127.0.0.1:18000 ausgeführt wird.
Halten Sie contextWindow mit ds4-server --ctx synchron. Halten Sie maxTokens mit --tokens synchron, sofern OpenClaw nicht absichtlich weniger Ausgabe als den Serverstandard anfordern soll.

Bedarfsgesteuerter Start

OpenClaw kann ds4 nur starten, wenn ein ds4/...-Modell ausgewählt ist. Fügen Sie localService demselben Provider-Eintrag hinzu:
command muss ein absoluter Pfad zu einer ausführbaren Datei sein. Shell-Suche und ~-Erweiterung werden nicht verwendet. Unter Lokale Modelldienste finden Sie alle localService-Felder.

Think Max

ds4 wendet Think Max nur an, wenn beides zutrifft:
  • ds4-server beginnt mit --ctx 393216 oder höher.
  • Die Anfrage verwendet reasoning_effort: "max" (oder das entsprechende ds4-Aufwandsfeld).
Wenn Sie diesen großen Kontext verwenden, aktualisieren Sie sowohl die Server-Flags als auch die OpenClaw-Modellmetadaten:

Test

Direkte HTTP-Prüfung unter Umgehung von OpenClaw:
OpenClaw-Modellrouting (wie bei der Schnellstartprüfung):
Vollständiger Smoke-Test für Agent und Tool-Aufrufe mit einem Kontext von mindestens 32768:
Erwartetes Ergebnis:
  • executionTrace.winnerProvider ist ds4
  • executionTrace.winnerModel ist deepseek-v4-flash
  • toolSummary.calls ist mindestens 1
  • finalAssistantVisibleText beginnt mit tool-ok

Fehlerbehebung

ds4 wird nicht ausgeführt oder ist nicht an den Host/Port in baseUrl gebunden. Starten Sie ds4-server und versuchen Sie es anschließend erneut:
Der konfigurierte Wert --ctx ist für den OpenClaw-Durchlauf zu klein. Erhöhen Sie ds4-server --ctx und aktualisieren Sie anschließend models.providers.ds4.models[].contextWindow entsprechend. Vollständige Agent-Durchläufe mit Tools benötigen erheblich mehr Kontext als eine direkte curl-Anfrage mit einer einzelnen Nachricht.
ds4 verwendet Think Max nur, wenn --ctx mindestens 393216 beträgt und die Anfrage reasoning_effort: "max" anfordert. Bei kleineren Kontexten wird auf hohes Reasoning zurückgegriffen.
ds4 durchläuft eine kalte Metal-Residenz- und Modellaufwärmphase. Legen Sie localService.readyTimeoutMs: 300000 fest, wenn OpenClaw den Server bei Bedarf startet.

Verwandte Themen

Lokale Modelldienste

Starten Sie lokale Modellserver bei Bedarf vor Modellanfragen.

Lokale Modelle

Wählen und betreiben Sie lokale Modell-Backends.

Modell-Provider

Konfigurieren Sie Provider-Referenzen, Authentifizierung und Failover.

DeepSeek

Natives Verhalten des DeepSeek-Providers und Steuerung des Denkprozesses.