Skip to main content
Moonshot proporciona la API de Kimi con endpoints compatibles con OpenAI. Seleccione moonshot/kimi-k3 para Kimi K3, mantenga el valor predeterminado de incorporación moonshot/kimi-k2.6 o use kimi/kimi-for-coding para Kimi Coding.
Moonshot y Kimi Coding son proveedores independientes, cada uno distribuido como un plugin externo distinto. Las claves no son intercambiables, los endpoints son diferentes y las referencias de modelo difieren (moonshot/... frente a kimi/...).

Catálogo de modelos integrado

Las estimaciones de costes del catálogo utilizan las tarifas de pago por uso publicadas por Moonshot. Consulte las páginas vigentes del proveedor sobre Kimi K3, Kimi K2.7 Code, Kimi K2.6 y Kimi K2.5 antes de tomar decisiones sobre costes. Kimi K3 siempre razona con reasoning_effort: "max". OpenClaw solo expone /think max, omite el campo exclusivo de K2 thinking y elimina las modificaciones de muestreo (temperature, top_p, n, presence_penalty y frequency_penalty) que K3 fija en los valores predeterminados del proveedor. Kimi K2.7 Code también utiliza siempre el pensamiento nativo, pero exige que se omitan tanto thinking como reasoning_effort; la variante HighSpeed utiliza el mismo contrato. Kimi K2.6 sigue siendo el valor predeterminado de incorporación. Consulte la guía de inicio rápido de Kimi K3 de Moonshot.

Primeros pasos

Tanto Moonshot como Kimi Coding son plugins externos: instale uno antes de iniciar la incorporación.
Más adecuado para: los modelos Kimi K3 y K2 mediante Moonshot Open Platform.
1

Instalar el plugin

2

Elegir la región del endpoint

3

Ejecutar la incorporación

O bien, para el endpoint de China:
4

Establecer Kimi K3 como modelo predeterminado

La incorporación mantiene Kimi K2.6 como valor predeterminado inicial. Cambie explícitamente cuando quiera usar Kimi K3:
5

Verificar que los modelos estén disponibles

6

Ejecutar una prueba rápida en vivo

Use un directorio de estado aislado cuando quiera verificar el acceso al modelo y el seguimiento de costes sin modificar sus sesiones habituales:
La respuesta JSON debe informar de provider: "moonshot" y model: "kimi-k3". La entrada de la transcripción del asistente almacena el uso normalizado de tokens y el coste estimado en usage.cost cuando Moonshot devuelve metadatos de uso.

Ejemplo de configuración

Búsqueda web de Kimi

El plugin de Moonshot también registra Kimi como proveedor de web_search, respaldado por la búsqueda web de Moonshot.
1

Ejecutar la configuración interactiva de la búsqueda web

Elija Kimi en la sección de búsqueda web para almacenar plugins.entries.moonshot.config.webSearch.*.
2

Configurar la región y el modelo de búsqueda web

La configuración interactiva solicita:
La configuración se encuentra en plugins.entries.moonshot.config.webSearch:

Configuración avanzada

Kimi K3 de la API de Moonshot siempre razona con el máximo esfuerzo. OpenClaw solo expone /think max, envía reasoning_effort: "max" e ignora los ajustes inferiores obsoletos o off.Kimi Code K3 expone /think off|max. Su endpoint compatible con Anthropic recibe thinking.type: "disabled" para desactivarlo, o pensamiento adaptativo con output_config.effort: "max" para el máximo. Esto se aplica tanto a kimi/k3 como a kimi/k3[1m]. La API K3 de Moonshot admite auto, none, required y selecciones de herramientas fijadas, por lo que OpenClaw conserva el tool_choice solicitado. Para el uso de herramientas en varios turnos, OpenClaw conserva el contenido de razonamiento del asistente requerido por el contrato de reproducción de Moonshot.Kimi K2.7 Code siempre utiliza pensamiento nativo. Moonshot exige que los clientes omitan el campo thinking para este modelo, por lo que OpenClaw solo expone on e ignora la configuración obsoleta de off. K2.7 también fija temperature, top_p, n, presence_penalty y frequency_penalty; OpenClaw omite las sobrescrituras configuradas para esos campos.Otros modelos Kimi de Moonshot admiten pensamiento nativo binario:
  • thinking: { type: "enabled" }
  • thinking: { type: "disabled" }
Configúrelo por modelo mediante agents.defaults.models.<provider/model>.params:
OpenClaw asigna los niveles de /think en tiempo de ejecución para esos modelos:
Cuando el pensamiento de Moonshot K2 está activado, tool_choice debe ser auto o none. Una selección de herramienta fijada (type: "tool" o type: "function") fuerza el pensamiento de vuelta a disabled, para que la herramienta solicitada siga ejecutándose; en cambio, tool_choice: "required" se normaliza a auto. Kimi K2.7 Code no puede desactivar el pensamiento, por lo que su tool_choice incompatible se normaliza a auto. Kimi K3 utiliza su contrato independiente de esfuerzo de razonamiento y conserva las selecciones de herramientas compatibles.
Kimi K2.6 también acepta un campo opcional thinking.keep que controla la retención de reasoning_content en varios turnos. Establézcalo en "all" para conservar el razonamiento completo entre turnos; omítalo (o déjelo en null) para utilizar la estrategia predeterminada del servidor. OpenClaw solo reenvía thinking.keep para moonshot/kimi-k2.6 y lo elimina de otros modelos. Kimi K2.7 Code conserva de forma predeterminada el historial de razonamiento completo, mientras que OpenClaw omite por completo el campo thinking.
Moonshot Kimi proporciona identificadores nativos de tool_call con el formato functions.<name>:<index>. OpenClaw conserva la primera aparición de cada identificador nativo de Kimi y reescribe los duplicados posteriores como identificadores deterministas de estilo OpenAI call_*. Los resultados de herramientas correspondientes se reasignan con el mismo identificador, de modo que la reproducción siga siendo única sin eliminar el primer identificador nativo de Kimi. Este comportamiento está integrado en el proveedor Moonshot incluido y no es una opción configurable por el usuario.
Los endpoints nativos de Moonshot (https://api.moonshot.ai/v1 y https://api.moonshot.cn/v1) anuncian compatibilidad con el uso en streaming. OpenClaw determina este comportamiento mediante el host del endpoint, no mediante el identificador del proveedor, por lo que un identificador de proveedor personalizado que apunte al mismo host nativo de Moonshot hereda el mismo comportamiento de uso en streaming.Con los precios de K2.6 del catálogo, el uso transmitido que incluye tokens de entrada, salida y lectura de caché también se convierte en un coste estimado local en USD para /status, /usage full, /usage cost y la contabilización de sesiones respaldada por transcripciones.
  • La búsqueda web de Kimi utiliza KIMI_API_KEY o MOONSHOT_API_KEY, y de forma predeterminada utiliza https://api.moonshot.ai/v1 con el modelo kimi-k2.6.
  • Si es necesario, sobrescriba los precios y los metadatos de contexto en models.providers.
  • Si Moonshot publica límites de contexto diferentes para un modelo, ajuste contextWindow en consecuencia.

Contenido relacionado

Selección de modelos

Elección de proveedores, referencias de modelos y comportamiento de conmutación por error.

Búsqueda web

Configuración de proveedores de búsqueda web, incluido Kimi.

Referencia de configuración

Esquema de configuración completo para proveedores, modelos y plugins.

Plataforma abierta de Moonshot

Gestión y documentación de claves de la API de Moonshot.