Skip to main content
ds4 предоставляет DeepSeek V4 Flash через локальный бэкенд Metal с совместимым с OpenAI API /v1. OpenClaw подключается к ds4 через универсальное семейство провайдеров openai-completions. ds4 не является встроенным плагином провайдера OpenClaw. Настройте его в разделе models.providers.ds4, затем выберите ds4/deepseek-v4-flash.

Требования

  • macOS с поддержкой Metal.
  • Рабочая копия репозитория ds4 с ds4-server и файлом GGUF DeepSeek V4 Flash.
  • Достаточный объём памяти для выбранного контекста; большие значения --ctx выделяют больше памяти KV при запуске сервера.
Запросы агентов OpenClaw включают схемы инструментов и контекст рабочего пространства. Малый контекст, например --ctx 4096, может успешно пройти прямые проверки через curl, но привести к сбою полных запусков агента с 500 prompt exceeds context. Для быстрых проверок агента и инструментов используйте как минимум --ctx 32768. Используйте --ctx 393216 только при наличии достаточного объёма памяти и для включения Think Max в ds4.

Быстрый старт

1

Запустите ds4-server

Замените <DS4_DIR> путём к вашей рабочей копии ds4.
2

Проверьте совместимую с OpenAI конечную точку

Ответ должен содержать deepseek-v4-flash.
3

Добавьте конфигурацию провайдера OpenClaw

Добавьте конфигурацию из раздела Полная конфигурация, затем выполните однократную проверку модели:

Полная конфигурация

Используйте эту конфигурацию, если ds4 уже запущен по адресу 127.0.0.1:18000.
Согласуйте contextWindow с ds4-server --ctx. Согласуйте maxTokens с --tokens, если только вы намеренно не хотите, чтобы OpenClaw запрашивал меньший объём вывода, чем задано на сервере по умолчанию.

Запуск по требованию

OpenClaw может запускать ds4 только при выборе модели ds4/.... Добавьте localService в ту же запись провайдера:
command должен быть абсолютным путём к исполняемому файлу. Поиск через оболочку и раскрытие ~ не используются. Описание всех полей localService см. в разделе Локальные сервисы моделей.

Think Max

ds4 применяет Think Max, только когда выполняются оба условия:
  • ds4-server начинается с --ctx 393216 или более высокого значения.
  • В запросе используется reasoning_effort: "max" (или эквивалентное поле уровня рассуждений ds4).
При использовании такого большого контекста обновите как флаги сервера, так и метаданные модели OpenClaw:

Проверка

Прямая проверка HTTP в обход OpenClaw:
Маршрутизация модели OpenClaw (аналогично проверке из раздела быстрого старта):
Быстрая проверка полного запуска агента и вызова инструментов с контекстом не менее 32768:
Ожидаемый результат:
  • executionTrace.winnerProvider имеет значение ds4
  • executionTrace.winnerModel имеет значение deepseek-v4-flash
  • toolSummary.calls составляет не менее 1
  • finalAssistantVisibleText начинается с tool-ok

Устранение неполадок

ds4 не запущен или не привязан к хосту/порту, указанному в baseUrl. Запустите ds4-server, затем повторите попытку:
Настроенное значение --ctx слишком мало для запроса OpenClaw. Увеличьте ds4-server --ctx, затем соответствующим образом обновите models.providers.ds4.models[].contextWindow. Полным запросам агента с инструментами требуется значительно больше контекста, чем прямому curl-запросу с одним сообщением.
ds4 использует Think Max, только когда --ctx составляет не менее 393216, а запрос запрашивает reasoning_effort: "max". При меньшем контексте используется высокий уровень рассуждений.
ds4 требуется время для первоначального размещения в Metal и прогрева модели. Задайте localService.readyTimeoutMs: 300000, когда OpenClaw запускает сервер по требованию.

Связанные материалы

Локальные сервисы моделей

Запускайте локальные серверы моделей по требованию перед запросами к моделям.

Локальные модели

Выбирайте и используйте локальные бэкенды моделей.

Провайдеры моделей

Настраивайте ссылки на провайдеров, аутентификацию и аварийное переключение.

DeepSeek

Нативное поведение провайдера DeepSeek и управление рассуждениями.