/v1 API 提供本地模型。OpenClaw 通过通用 openai-completions 适配器与其通信。
入门指南
1
使用模型启动 inferrs
2
验证服务器是否可访问
3
添加 OpenClaw 提供商条目
添加明确的提供商条目,并将默认模型指向该条目。请参阅下方的配置示例。
完整配置示例
本地inferrs 服务器上的 Gemma 4:
按需启动
仅当选择了inferrs/... 模型时,OpenClaw 才能自行启动 inferrs。将 localService 添加到同一提供商条目:
command 必须是绝对路径。在 Gateway 网关主机上运行 which inferrs 并使用该路径。完整字段参考:本地模型服务。
高级配置
requiresStringContent 为何重要
requiresStringContent 为何重要
某些
inferrs Chat Completions 路由仅接受字符串 messages[].content,不接受结构化的内容部分数组。Gemma 与工具架构注意事项
Gemma 与工具架构注意事项
某些 这可以减轻更严格的本地后端所承受的提示词压力。如果微型直接请求仍然有效,但正常的 OpenClaw Agent 轮次仍持续在
inferrs + Gemma 组合能够接受小型的直接 /v1/chat/completions 请求,但在完整的 OpenClaw Agent 运行时轮次中失败。请先尝试禁用工具架构表面:inferrs 内崩溃,应将其视为上游模型或服务器限制,而不是 OpenClaw 传输问题。手动冒烟测试
手动冒烟测试
配置后测试两个层级:如果第一个命令有效但第二个失败,请参阅下方的故障排查。
代理式行为
代理式行为
由于
inferrs 使用通用 openai-completions 适配器(而非 openai-responses),因此绝不会应用仅限原生 OpenAI 的请求整形:不会发送 service_tier、Responses store、提示词缓存提示或 OpenAI 推理兼容性载荷整形。故障排查
curl /v1/models 失败
curl /v1/models 失败
inferrs 未运行、无法访问,或未绑定到所配置的主机或端口。请确认服务器已启动并正在该地址上监听。messages[].content 应为字符串
messages[].content 应为字符串
在模型条目中设置
compat.requiresStringContent: true(见上文)。直接调用 /v1/chat/completions 成功,但 openclaw infer model run 失败
直接调用 /v1/chat/completions 成功,但 openclaw infer model run 失败
设置
compat.supportsTools: false 以禁用工具架构表面(请参阅上方的 Gemma 注意事项)。inferrs 在较大的 Agent 轮次中仍会崩溃
inferrs 在较大的 Agent 轮次中仍会崩溃
如果架构错误已消失,但
inferrs 在较大的 Agent 轮次中仍会崩溃,请将其视为上游 inferrs 或模型限制。请减轻提示词压力,或更换后端或模型。相关内容
本地模型
使用本地模型服务器运行 OpenClaw。
本地模型服务
为已配置的提供商按需启动本地模型服务器。
Gateway 网关故障排查
调试能够通过探测但在 Agent 运行时失败的本地 OpenAI 兼容后端。
模型选择
所有提供商、模型引用和故障转移行为的概览。