/v1 API。OpenClaw 通过通用 openai-completions 提供商系列连接到 ds4。
ds4 不是 OpenClaw 内置的提供商插件。请在
models.providers.ds4 下配置它,然后选择 ds4/deepseek-v4-flash。
要求
- 支持 Metal 的 macOS。
- 可正常工作的 ds4 检出目录,其中包含
ds4-server和 DeepSeek V4 Flash GGUF 文件。 - 足够的内存以容纳所选上下文;更大的
--ctx值会在服务器启动时分配更多 KV 内存。
快速开始
1
启动 ds4-server
将
<DS4_DIR> 替换为 ds4 检出目录的路径。2
验证兼容 OpenAI 的端点
deepseek-v4-flash。3
添加 OpenClaw 提供商配置
添加完整配置中的配置,然后运行一次性模型
检查:
完整配置
当 ds4 已在127.0.0.1:18000 上运行时,请使用此配置。
contextWindow 与 ds4-server --ctx 保持一致。让 maxTokens 与
--tokens 保持一致,除非你有意让 OpenClaw 请求比服务器默认值更少的输出。
按需启动
OpenClaw 可以仅在选择ds4/... 模型时启动 ds4。将
localService 添加到同一个提供商条目:
command 必须是绝对可执行文件路径。不会使用 shell 查找或 ~ 展开。
有关所有 localService 字段,请参阅本地模型服务。
Think Max
仅当以下两个条件都满足时,ds4 才会应用 Think Max:ds4-server以--ctx 393216或更高值启动。- 请求使用
reasoning_effort: "max"(或等效的 ds4 工作强度字段)。
测试
绕过 OpenClaw 进行直接 HTTP 检查:executionTrace.winnerProvider为ds4executionTrace.winnerModel为deepseek-v4-flashtoolSummary.calls至少为1finalAssistantVisibleText以tool-ok开头
故障排查
curl /v1/models 无法连接
curl /v1/models 无法连接
ds4 未运行,或未绑定到
baseUrl 中的主机/端口。启动
ds4-server,然后重试:500 提示词超出上下文
500 提示词超出上下文
配置的
--ctx 对 OpenClaw 轮次来说太小。增大
ds4-server --ctx,然后更新 models.providers.ds4.models[].contextWindow
以保持一致。包含工具的完整智能体轮次需要的上下文远多于直接发送单条消息的 curl 请求。Think Max 未激活
Think Max 未激活
仅当
--ctx 至少为 393216,并且请求要求
reasoning_effort: "max" 时,ds4 才会使用 Think Max。较小的上下文会回退到高强度
推理。首次请求较慢
首次请求较慢
ds4 存在 Metal 冷驻留和模型预热阶段。当 OpenClaw 按需启动服务器时,请设置
localService.readyTimeoutMs: 300000。相关内容
本地模型服务
在模型请求前按需启动本地模型服务器。
本地模型
选择并运行本地模型后端。
模型提供商
配置提供商引用、身份验证和故障转移。
DeepSeek
DeepSeek 原生提供商行为和思考控制。