/v1-API bereit. OpenClaw verbindet sich mit ds4
über die generische openai-completions-Provider-Familie.
ds4 ist kein mitgeliefertes OpenClaw-Provider-Plugin. Konfigurieren Sie es unter
models.providers.ds4 und wählen Sie anschließend ds4/deepseek-v4-flash aus.
Anforderungen
- macOS mit Metal-Unterstützung.
- Ein funktionsfähiger ds4-Checkout mit
ds4-serverund der GGUF-Datei für DeepSeek V4 Flash. - Ausreichend Arbeitsspeicher für den gewählten Kontext; größere
--ctx-Werte weisen beim Serverstart mehr KV-Speicher zu.
Schnellstart
1
ds4-server starten
Ersetzen Sie
<DS4_DIR> durch den Pfad zu Ihrem ds4-Checkout.2
OpenAI-kompatiblen Endpunkt überprüfen
deepseek-v4-flash enthalten.3
OpenClaw-Provider-Konfiguration hinzufügen
Fügen Sie die Konfiguration aus Vollständige Konfiguration hinzu und führen Sie anschließend
eine einmalige Modellprüfung aus:
Vollständige Konfiguration
Verwenden Sie diese Konfiguration, wenn ds4 bereits unter127.0.0.1:18000 ausgeführt wird.
contextWindow mit ds4-server --ctx synchron. Halten Sie maxTokens
mit --tokens synchron, sofern OpenClaw nicht absichtlich weniger Ausgabe
als den Serverstandard anfordern soll.
Bedarfsgesteuerter Start
OpenClaw kann ds4 nur starten, wenn einds4/...-Modell ausgewählt ist. Fügen Sie
localService demselben Provider-Eintrag hinzu:
command muss ein absoluter Pfad zu einer ausführbaren Datei sein. Shell-Suche und
~-Erweiterung werden nicht verwendet. Unter Lokale Modelldienste
finden Sie alle localService-Felder.
Think Max
ds4 wendet Think Max nur an, wenn beides zutrifft:ds4-serverbeginnt mit--ctx 393216oder höher.- Die Anfrage verwendet
reasoning_effort: "max"(oder das entsprechende ds4-Aufwandsfeld).
Test
Direkte HTTP-Prüfung unter Umgehung von OpenClaw:executionTrace.winnerProvideristds4executionTrace.winnerModelistdeepseek-v4-flashtoolSummary.callsist mindestens1finalAssistantVisibleTextbeginnt mittool-ok
Fehlerbehebung
curl /v1/models kann keine Verbindung herstellen
curl /v1/models kann keine Verbindung herstellen
ds4 wird nicht ausgeführt oder ist nicht an den Host/Port in
baseUrl gebunden. Starten Sie
ds4-server und versuchen Sie es anschließend erneut:500 – Prompt überschreitet den Kontext
500 – Prompt überschreitet den Kontext
Der konfigurierte Wert
--ctx ist für den OpenClaw-Durchlauf zu klein. Erhöhen Sie
ds4-server --ctx und aktualisieren Sie anschließend models.providers.ds4.models[].contextWindow
entsprechend. Vollständige Agent-Durchläufe mit Tools benötigen erheblich mehr Kontext als
eine direkte curl-Anfrage mit einer einzelnen Nachricht.Think Max wird nicht aktiviert
Think Max wird nicht aktiviert
ds4 verwendet Think Max nur, wenn
--ctx mindestens 393216 beträgt und die Anfrage
reasoning_effort: "max" anfordert. Bei kleineren Kontexten wird auf hohes
Reasoning zurückgegriffen.Die erste Anfrage ist langsam
Die erste Anfrage ist langsam
ds4 durchläuft eine kalte Metal-Residenz- und Modellaufwärmphase. Legen Sie
localService.readyTimeoutMs: 300000 fest, wenn OpenClaw den Server bei
Bedarf startet.Verwandte Themen
Lokale Modelldienste
Starten Sie lokale Modellserver bei Bedarf vor Modellanfragen.
Lokale Modelle
Wählen und betreiben Sie lokale Modell-Backends.
Modell-Provider
Konfigurieren Sie Provider-Referenzen, Authentifizierung und Failover.
DeepSeek
Natives Verhalten des DeepSeek-Providers und Steuerung des Denkprozesses.