/v1. OpenClaw подключается к ds4
через универсальное семейство провайдеров openai-completions.
ds4 не является встроенным плагином провайдера OpenClaw. Настройте его в разделе
models.providers.ds4, затем выберите ds4/deepseek-v4-flash.
Требования
- macOS с поддержкой Metal.
- Рабочая копия репозитория ds4 с
ds4-serverи файлом GGUF DeepSeek V4 Flash. - Достаточный объём памяти для выбранного контекста; большие значения
--ctxвыделяют больше памяти KV при запуске сервера.
Быстрый старт
1
Запустите ds4-server
Замените
<DS4_DIR> путём к вашей рабочей копии ds4.2
Проверьте совместимую с OpenAI конечную точку
deepseek-v4-flash.3
Добавьте конфигурацию провайдера OpenClaw
Добавьте конфигурацию из раздела Полная конфигурация, затем выполните однократную
проверку модели:
Полная конфигурация
Используйте эту конфигурацию, если ds4 уже запущен по адресу127.0.0.1:18000.
contextWindow с ds4-server --ctx. Согласуйте maxTokens
с --tokens, если только вы намеренно не хотите, чтобы OpenClaw запрашивал меньший объём вывода,
чем задано на сервере по умолчанию.
Запуск по требованию
OpenClaw может запускать ds4 только при выборе моделиds4/.... Добавьте
localService в ту же запись провайдера:
command должен быть абсолютным путём к исполняемому файлу. Поиск через оболочку и раскрытие ~
не используются. Описание всех полей localService см. в разделе Локальные сервисы моделей.
Think Max
ds4 применяет Think Max, только когда выполняются оба условия:ds4-serverначинается с--ctx 393216или более высокого значения.- В запросе используется
reasoning_effort: "max"(или эквивалентное поле уровня рассуждений ds4).
Проверка
Прямая проверка HTTP в обход OpenClaw:executionTrace.winnerProviderимеет значениеds4executionTrace.winnerModelимеет значениеdeepseek-v4-flashtoolSummary.callsсоставляет не менее1finalAssistantVisibleTextначинается сtool-ok
Устранение неполадок
curl не удаётся подключиться к /v1/models
curl не удаётся подключиться к /v1/models
ds4 не запущен или не привязан к хосту/порту, указанному в
baseUrl. Запустите
ds4-server, затем повторите попытку:500: запрос превышает размер контекста
500: запрос превышает размер контекста
Настроенное значение
--ctx слишком мало для запроса OpenClaw. Увеличьте
ds4-server --ctx, затем соответствующим образом обновите models.providers.ds4.models[].contextWindow.
Полным запросам агента с инструментами требуется значительно больше контекста, чем
прямому curl-запросу с одним сообщением.Think Max не активируется
Think Max не активируется
ds4 использует Think Max, только когда
--ctx составляет не менее 393216, а запрос
запрашивает reasoning_effort: "max". При меньшем контексте используется высокий
уровень рассуждений.Первый запрос выполняется медленно
Первый запрос выполняется медленно
ds4 требуется время для первоначального размещения в Metal и прогрева модели. Задайте
localService.readyTimeoutMs: 300000, когда OpenClaw запускает сервер
по требованию.Связанные материалы
Локальные сервисы моделей
Запускайте локальные серверы моделей по требованию перед запросами к моделям.
Локальные модели
Выбирайте и используйте локальные бэкенды моделей.
Провайдеры моделей
Настраивайте ссылки на провайдеров, аутентификацию и аварийное переключение.
DeepSeek
Нативное поведение провайдера DeepSeek и управление рассуждениями.