Skip to main content
ds4 udostępnia DeepSeek V4 Flash z lokalnego backendu Metal za pośrednictwem interfejsu API /v1 zgodnego z OpenAI. OpenClaw łączy się z ds4 przez ogólną rodzinę dostawców openai-completions. ds4 nie jest dołączonym Pluginem dostawcy OpenClaw. Skonfiguruj go w models.providers.ds4, a następnie wybierz ds4/deepseek-v4-flash.

Wymagania

  • macOS z obsługą Metal.
  • Działająca kopia robocza ds4 z ds4-server oraz plikiem GGUF DeepSeek V4 Flash.
  • Wystarczająca ilość pamięci dla wybranego kontekstu; większe wartości --ctx przydzielają więcej pamięci KV podczas uruchamiania serwera.
Tury agenta OpenClaw zawierają schematy narzędzi i kontekst przestrzeni roboczej. Mały kontekst, taki jak --ctx 4096, może przejść bezpośrednie testy curl, ale powodować niepowodzenie pełnych uruchomień agenta z błędem 500 prompt exceeds context. Do testów dymnych agenta i narzędzi używaj co najmniej --ctx 32768. Wartości --ctx 393216 używaj tylko przy wystarczającej ilości pamięci oraz w celu włączenia Think Max w ds4.

Szybki start

1

Start ds4-server

Zastąp <DS4_DIR> ścieżką do swojej kopii roboczej ds4.
2

Verify the OpenAI-compatible endpoint

Odpowiedź powinna zawierać deepseek-v4-flash.
3

Add the OpenClaw provider config

Dodaj konfigurację z sekcji Pełna konfiguracja, a następnie uruchom jednorazowe sprawdzenie modelu:

Pełna konfiguracja

Użyj tej konfiguracji, gdy ds4 jest już uruchomiony pod adresem 127.0.0.1:18000.
Utrzymuj contextWindow zgodne z ds4-server --ctx. Utrzymuj maxTokens zgodne z --tokens, chyba że celowo chcesz, aby OpenClaw żądał mniejszej ilości danych wyjściowych niż domyślna wartość serwera.

Uruchamianie na żądanie

OpenClaw może uruchamiać ds4 tylko wtedy, gdy wybrany jest model ds4/.... Dodaj localService do tego samego wpisu dostawcy:
command musi być bezwzględną ścieżką do pliku wykonywalnego. Wyszukiwanie przez powłokę ani rozwijanie ~ nie są używane. Opis wszystkich pól localService znajdziesz w sekcji Lokalne usługi modeli.

Think Max

ds4 stosuje Think Max tylko wtedy, gdy oba warunki są spełnione:
  • ds4-server uruchamia się z wartością --ctx 393216 lub większą.
  • Żądanie używa reasoning_effort: "max" (lub równoważnego pola poziomu wysiłku ds4).
Jeśli używasz tak dużego kontekstu, zaktualizuj zarówno flagi serwera, jak i metadane modelu OpenClaw:

Test

Bezpośrednie sprawdzenie HTTP z pominięciem OpenClaw:
Trasowanie modelu OpenClaw (takie samo jak sprawdzenie w sekcji Szybki start):
Pełny test dymny agenta i wywołań narzędzi z kontekstem wynoszącym co najmniej 32768:
Oczekiwany wynik:
  • executionTrace.winnerProvider ma wartość ds4
  • executionTrace.winnerModel ma wartość deepseek-v4-flash
  • toolSummary.calls wynosi co najmniej 1
  • finalAssistantVisibleText zaczyna się od tool-ok

Rozwiązywanie problemów

ds4 nie jest uruchomiony albo nie nasłuchuje na hoście lub porcie określonym w baseUrl. Uruchom ds4-server, a następnie spróbuj ponownie:
Skonfigurowana wartość --ctx jest zbyt mała dla tury OpenClaw. Zwiększ ds4-server --ctx, a następnie odpowiednio zaktualizuj models.providers.ds4.models[].contextWindow. Pełne tury agenta z narzędziami wymagają znacznie większego kontekstu niż bezpośrednie żądanie curl z pojedynczą wiadomością.
ds4 używa Think Max tylko wtedy, gdy --ctx wynosi co najmniej 393216, a żądanie określa reasoning_effort: "max". Mniejsze konteksty powodują powrót do wysokiego poziomu rozumowania.
ds4 ma fazę początkowego umieszczania w pamięci Metal i rozgrzewania modelu. Ustaw localService.readyTimeoutMs: 300000, gdy OpenClaw uruchamia serwer na żądanie.

Powiązane

Local model services

Uruchamiaj lokalne serwery modeli na żądanie przed żądaniami do modeli.

Local models

Wybieraj i obsługuj lokalne backendy modeli.

Model providers

Konfiguruj odwołania do dostawców, uwierzytelnianie i przełączanie awaryjne.

DeepSeek

Natywne zachowanie dostawcy DeepSeek i ustawienia sterujące myśleniem.