Skip to main content
Moonshot 提供具有 OpenAI 兼容端点的 Kimi API。选择 moonshot/kimi-k3 以使用 Kimi K3,保留新手引导默认值 moonshot/kimi-k2.6,或使用 kimi/kimi-for-coding 以使用 Kimi Coding。
Moonshot 和 Kimi Coding 是独立的提供商,分别作为独立的外部插件提供。两者的密钥不能互换,端点不同,模型引用也不同(moonshot/...kimi/...)。

内置模型目录

目录中的成本估算采用 Moonshot 公布的按量付费费率。在做出成本决策前,请查看供应商的实时页面:Kimi K3Kimi K2.7 CodeKimi K2.6Kimi K2.5 Kimi K3 始终以 reasoning_effort: "max" 进行推理。OpenClaw 仅公开 /think max,省略仅适用于 K2 的 thinking 字段,并移除 K3 固定为提供商默认值的采样覆盖项(temperaturetop_pnpresence_penaltyfrequency_penalty)。Kimi K2.7 Code 也始终使用原生思考,但要求同时省略 thinkingreasoning_effort;HighSpeed 变体使用相同的约定。 Kimi K2.6 仍是新手引导默认值。 请参阅 Moonshot 的 Kimi K3 快速开始

入门指南

Moonshot 和 Kimi Coding 都是外部插件——请先安装其中一个,再进行新手引导。
**最适合:**通过 Moonshot 开放平台使用 Kimi K3 和 K2 模型。
1

安装插件

2

选择端点区域

3

运行新手引导

对于中国端点:
4

将 Kimi K3 设为默认模型

新手引导会保留 Kimi K2.6 作为初始默认模型。需要使用 Kimi K3 时,请显式切换:
5

验证模型是否可用

6

运行实时冒烟测试

如果想在不影响正常会话的情况下验证模型访问和成本跟踪,请使用隔离的状态目录:
JSON 响应应报告 provider: "moonshot"model: "kimi-k3"。当 Moonshot 返回用量元数据时,助手转录条目会在 usage.cost 下存储标准化的 token 用量和估算成本。

配置示例

Kimi Web 搜索

Moonshot 插件还会将 Kimi 注册为 web_search 提供商,其后端由 Moonshot Web 搜索提供支持。
1

运行交互式 Web 搜索设置

在 Web 搜索部分选择 Kimi,以存储 plugins.entries.moonshot.config.webSearch.*
2

配置 Web 搜索区域和模型

交互式设置会提示配置:
配置位于 plugins.entries.moonshot.config.webSearch 下:

高级配置

Moonshot API Kimi K3 始终以最大强度进行推理。OpenClaw 仅公开 /think max,发送 reasoning_effort: "max",并忽略过时的较低级别或 off 设置。Kimi Code K3 提供 /think off|max。其 Anthropic 兼容端点 接收用于关闭的 thinking.type: "disabled",或使用 output_config.effort: "max" 表示最大值的自适应思考。这同时适用于 kimi/k3kimi/k3[1m]。 Moonshot API K3 支持 autononerequired 和固定工具选择, 因此 OpenClaw 会保留请求的 tool_choice。对于多轮工具使用, OpenClaw 会保留 Moonshot 重放契约所需的助手推理内容。Kimi K2.7 Code 始终使用原生思考。Moonshot 要求客户端 对此模型省略 thinking 字段,因此 OpenClaw 仅提供 on, 并忽略过时的 off 设置。K2.7 还固定了 temperaturetop_pnpresence_penaltyfrequency_penalty;OpenClaw 会省略这些字段已配置的 覆盖值。其他 Moonshot Kimi 模型支持二元原生思考:
  • thinking: { type: "enabled" }
  • thinking: { type: "disabled" }
通过 agents.defaults.models.<provider/model>.params 按模型配置:
OpenClaw 会为这些模型映射运行时 /think 级别:
启用 Moonshot K2 思考时,tool_choice 必须为 autonone。固定工具选择(type: "tool"type: "function")会改为强制将思考恢复为 disabled,以便请求的工具仍能运行;tool_choice: "required" 则会被规范化为 auto。Kimi K2.7 Code 无法禁用思考,因此其不兼容的 tool_choice 会被规范化为 auto。Kimi K3 使用独立的推理强度契约,并保留受支持的工具选择。
Kimi K2.6 还接受可选的 thinking.keep 字段,用于控制 reasoning_content 的多轮保留。将其设为 "all" 可在各轮之间保留完整 推理;省略该字段(或保留为 null)则使用服务器 默认策略。OpenClaw 仅为 moonshot/kimi-k2.6 转发 thinking.keep,并从其他模型中移除该字段。Kimi K2.7 Code 默认保留完整推理历史记录,而 OpenClaw 会省略整个 thinking 字段。
Moonshot Kimi 提供形如 functions.<name>:<index> 的原生 tool_call ID。OpenClaw 会保留每个原生 Kimi ID 的首次出现,并将之后的重复项重写为确定性的 OpenAI 风格 call_* ID。匹配的工具结果会使用同一 ID 重新映射,因此重放仍保持唯一,同时不会移除 Kimi 的首个原生 ID。此行为已接入内置 Moonshot provider,无法由用户配置。
原生 Moonshot 端点(https://api.moonshot.ai/v1https://api.moonshot.cn/v1)声明支持流式用量兼容性。 OpenClaw 根据端点主机而非 provider ID 判断,因此指向相同原生 Moonshot 主机的自定义 provider ID 会继承相同的 流式用量行为。使用目录中的 K2.6 定价时,包含输入、输出和 缓存读取 token 的流式用量还会转换为本地预估美元费用,用于 /status/usage full/usage cost 和基于转录记录的会话 计费。
  • Kimi Web 搜索使用 KIMI_API_KEYMOONSHOT_API_KEY,默认使用 https://api.moonshot.ai/v1,模型为 kimi-k2.6
  • 如有需要,可在 models.providers 中覆盖定价和上下文元数据。
  • 如果 Moonshot 为某个模型发布了不同的上下文限制,请相应调整 contextWindow

相关内容

模型选择

选择提供商、模型引用和故障转移行为。

Web 搜索

配置包括 Kimi 在内的 Web 搜索提供商。

配置参考

提供商、模型和插件的完整配置模式。

Moonshot 开放平台

Moonshot API 密钥管理和文档。