Skip to main content
ds4는 로컬 Metal 백엔드에서 OpenAI 호환 /v1 API를 통해 DeepSeek V4 Flash를 제공합니다. OpenClaw는 범용 openai-completions 제공자 계열을 통해 ds4에 연결합니다. ds4는 OpenClaw에 번들로 포함된 제공자 Plugin이 아닙니다. models.providers.ds4 아래에 구성한 다음 ds4/deepseek-v4-flash를 선택하세요.

요구 사항

  • Metal을 지원하는 macOS.
  • ds4-server와 DeepSeek V4 Flash GGUF 파일이 있는 정상 작동하는 ds4 체크아웃.
  • 선택한 컨텍스트에 충분한 메모리. --ctx 값이 클수록 서버 시작 시 더 많은 KV 메모리가 할당됩니다.
OpenClaw 에이전트 턴에는 도구 스키마와 작업 공간 컨텍스트가 포함됩니다. --ctx 4096처럼 작은 컨텍스트는 직접 curl 테스트를 통과할 수 있지만 전체 에이전트 실행에서는 500 prompt exceeds context 오류가 발생할 수 있습니다. 에이전트 및 도구 스모크 테스트에는 최소 --ctx 32768을 사용하세요. 메모리가 충분하고 ds4 Think Max를 활성화하려는 경우에만 --ctx 393216을 사용하세요.

빠른 시작

1

ds4-server 시작

<DS4_DIR>을 ds4 체크아웃 경로로 바꾸세요.
2

OpenAI 호환 엔드포인트 확인

응답에 deepseek-v4-flash가 포함되어야 합니다.
3

OpenClaw 제공자 구성 추가

전체 구성의 구성을 추가한 다음 일회성 모델 검사를 실행하세요.

전체 구성

ds4가 이미 127.0.0.1:18000에서 실행 중일 때 이 구성을 사용하세요.
contextWindowds4-server --ctx와 일치시키세요. OpenClaw가 서버 기본값보다 적은 출력을 의도적으로 요청하도록 하려는 경우가 아니라면 maxTokens--tokens와 일치시키세요.

주문형 시작

OpenClaw는 ds4/... 모델이 선택된 경우에만 ds4를 시작할 수 있습니다. 동일한 제공자 항목에 localService를 추가하세요.
command는 절대 실행 파일 경로여야 합니다. 셸 조회와 ~ 확장은 사용되지 않습니다. 모든 localService 필드는 로컬 모델 서비스를 참조하세요.

Think Max

ds4는 다음 두 조건이 모두 충족될 때만 Think Max를 적용합니다.
  • ds4-server--ctx 393216 이상으로 시작됩니다.
  • 요청이 reasoning_effort: "max" 또는 이에 해당하는 ds4 노력 필드를 사용합니다.
이처럼 큰 컨텍스트를 실행하는 경우 서버 플래그와 OpenClaw 모델 메타데이터를 모두 업데이트하세요.

테스트

OpenClaw를 우회하는 직접 HTTP 검사:
OpenClaw 모델 라우팅(빠른 시작 검사와 동일):
최소 32768의 컨텍스트를 사용하는 전체 에이전트 및 도구 호출 스모크 테스트:
예상 결과:
  • executionTrace.winnerProviderds4
  • executionTrace.winnerModeldeepseek-v4-flash
  • toolSummary.calls1 이상임
  • finalAssistantVisibleTexttool-ok로 시작함

문제 해결

ds4가 실행 중이 아니거나 baseUrl의 호스트/포트에 바인딩되지 않았습니다. ds4-server를 시작한 다음 다시 시도하세요.
구성된 --ctx가 OpenClaw 턴에 비해 너무 작습니다. ds4-server --ctx를 늘린 다음 models.providers.ds4.models[].contextWindow을 일치하도록 업데이트하세요. 도구가 포함된 전체 에이전트 턴에는 메시지 하나를 사용하는 직접 curl 요청보다 훨씬 많은 컨텍스트가 필요합니다.
ds4는 --ctx가 최소 393216이고 요청이 reasoning_effort: "max"를 요구할 때만 Think Max를 사용합니다. 더 작은 컨텍스트에서는 높은 수준의 추론으로 대체됩니다.
ds4에는 초기 Metal 상주 및 모델 워밍업 단계가 있습니다. OpenClaw가 필요할 때 서버를 시작하도록 하는 경우 localService.readyTimeoutMs: 300000을 설정하세요.

관련 항목

로컬 모델 서비스

모델 요청 전에 필요할 때 로컬 모델 서버를 시작합니다.

로컬 모델

로컬 모델 백엔드를 선택하고 운영합니다.

모델 제공자

제공자 참조, 인증 및 장애 조치를 구성합니다.

DeepSeek

기본 DeepSeek 제공자 동작 및 사고 제어입니다.