Skip to main content
Moonshot stellt die Kimi-API mit OpenAI-kompatiblen Endpunkten bereit. Wählen Sie moonshot/kimi-k3 für Kimi K3, behalten Sie den Onboarding-Standard moonshot/kimi-k2.6 bei oder verwenden Sie kimi/kimi-for-coding für Kimi Coding.
Moonshot und Kimi Coding sind separate Provider, die jeweils als separates externes Plugin ausgeliefert werden. Schlüssel sind nicht austauschbar, die Endpunkte unterscheiden sich und die Modellreferenzen unterscheiden sich (moonshot/... gegenüber kimi/...).

Integrierter Modellkatalog

Die Kostenschätzungen im Katalog verwenden die von Moonshot veröffentlichten nutzungsabhängigen Tarife. Prüfen Sie vor Kostenentscheidungen die aktuellen Anbieterseiten für Kimi K3, Kimi K2.7 Code, Kimi K2.6 und Kimi K2.5. Kimi K3 schlussfolgert immer mit reasoning_effort: "max". OpenClaw stellt nur /think max bereit, lässt das ausschließlich für K2 vorgesehene Feld thinking weg und entfernt Sampling- Überschreibungen (temperature, top_p, n, presence_penalty und frequency_penalty), die K3 auf die Provider-Standards festlegt. Kimi K2.7 Code verwendet ebenfalls immer natives Denken, erfordert jedoch, dass sowohl thinking als auch reasoning_effort weggelassen werden; die HighSpeed-Variante verwendet denselben Vertrag. Kimi K2.6 bleibt der Onboarding-Standard. Siehe Moonshots Kimi-K3-Schnellstart.

Erste Schritte

Sowohl Moonshot als auch Kimi Coding sind externe Plugins – installieren Sie eines davon vor dem Onboarding.
Am besten geeignet für: Kimi-K3- und K2-Modelle über die Moonshot Open Platform.
1

Plugin installieren

2

Endpunktregion auswählen

3

Onboarding ausführen

Oder für den China-Endpunkt:
4

Kimi K3 als Standardmodell festlegen

Beim Onboarding bleibt Kimi K2.6 zunächst das Standardmodell. Wechseln Sie ausdrücklich, wenn Sie Kimi K3 verwenden möchten:
5

Verfügbarkeit der Modelle überprüfen

6

Live-Smoke-Test ausführen

Verwenden Sie ein isoliertes Zustandsverzeichnis, wenn Sie den Modellzugriff und die Kostenverfolgung überprüfen möchten, ohne Ihre normalen Sitzungen zu verändern:
Die JSON-Antwort sollte provider: "moonshot" und model: "kimi-k3" melden. Der Assistenten-Transkripteintrag speichert die normalisierte Token-Nutzung sowie die geschätzten Kosten unter usage.cost, wenn Moonshot Nutzungsmetadaten zurückgibt.

Konfigurationsbeispiel

Kimi-Websuche

Das Moonshot-Plugin registriert außerdem Kimi als web_search-Provider, der auf der Moonshot-Websuche basiert.
1

Interaktive Einrichtung der Websuche ausführen

Wählen Sie im Websuchabschnitt Kimi, um plugins.entries.moonshot.config.webSearch.* zu speichern.
2

Region und Modell der Websuche konfigurieren

Bei der interaktiven Einrichtung werden Sie zu Folgendem aufgefordert:
Die Konfiguration befindet sich unter plugins.entries.moonshot.config.webSearch:

Erweiterte Konfiguration

Moonshot API Kimi K3 schlussfolgert immer mit maximalem Aufwand. OpenClaw stellt nur /think max bereit, sendet reasoning_effort: "max" und ignoriert veraltete niedrigere oder off-Einstellungen.Kimi Code K3 stellt /think off|max bereit. Sein Anthropic-kompatibler Endpunkt empfängt thinking.type: "disabled" zum Deaktivieren oder adaptives Thinking mit output_config.effort: "max" für das Maximum. Dies gilt sowohl für kimi/k3 als auch für kimi/k3[1m]. Moonshot API K3 unterstützt auto, none, required und festgelegte Tool-Auswahlen, sodass OpenClaw die angeforderte tool_choice beibehält. Bei der mehrstufigen Tool-Nutzung behält OpenClaw die vom Replay-Vertrag von Moonshot benötigten Reasoning-Inhalte des Assistenten bei.Kimi K2.7 Code verwendet immer natives Thinking. Moonshot verlangt von Clients, das Feld thinking für dieses Modell wegzulassen, daher stellt OpenClaw nur on bereit und ignoriert veraltete off-Einstellungen. K2.7 legt außerdem temperature, top_p, n, presence_penalty und frequency_penalty fest; OpenClaw lässt konfigurierte Überschreibungen für diese Felder weg.Andere Moonshot-Kimi-Modelle unterstützen binäres natives Thinking:
  • thinking: { type: "enabled" }
  • thinking: { type: "disabled" }
Konfigurieren Sie es über agents.defaults.models.<provider/model>.params für jedes Modell separat:
OpenClaw ordnet die Laufzeitstufen von /think für diese Modelle wie folgt zu:
Wenn Thinking für Moonshot K2 aktiviert ist, muss tool_choice den Wert auto oder none haben. Eine festgelegte Tool-Auswahl (type: "tool" oder type: "function") setzt Thinking stattdessen zwangsweise auf disabled zurück, damit das angeforderte Tool weiterhin ausgeführt wird; tool_choice: "required" wird stattdessen zu auto normalisiert. Bei Kimi K2.7 Code kann Thinking nicht deaktiviert werden, daher wird sein inkompatibles tool_choice zu auto normalisiert. Kimi K3 verwendet seinen separaten Vertrag für den Reasoning-Aufwand und behält unterstützte Tool-Auswahlen bei.
Kimi K2.6 akzeptiert außerdem ein optionales Feld thinking.keep, das die turnübergreifende Beibehaltung von reasoning_content steuert. Setzen Sie es auf "all", um das vollständige Reasoning über mehrere Turns hinweg beizubehalten; lassen Sie es weg (oder belassen Sie es bei null), um die Standardstrategie des Servers zu verwenden. OpenClaw leitet thinking.keep nur für moonshot/kimi-k2.6 weiter und entfernt es bei anderen Modellen. Kimi K2.7 Code behält standardmäßig den vollständigen Reasoning-Verlauf bei, während OpenClaw das gesamte Feld thinking weglässt.
Moonshot Kimi stellt native tool_call-IDs im Format functions.<name>:<index> bereit. OpenClaw behält das erste Vorkommen jeder nativen Kimi-ID bei und schreibt spätere Duplikate in deterministische IDs im OpenAI-Stil call_* um. Zugehörige Tool-Ergebnisse werden derselben ID zugeordnet, sodass das Replay eindeutig bleibt, ohne die erste native ID von Kimi zu entfernen. Dieses Verhalten ist fest in den gebündelten Moonshot-Provider integriert und keine vom Benutzer konfigurierbare Einstellung.
Native Moonshot-Endpunkte (https://api.moonshot.ai/v1 und https://api.moonshot.cn/v1) weisen Kompatibilität mit Streaming-Nutzungsdaten aus. OpenClaw richtet sich dabei nach dem Host des Endpunkts, nicht nach der Provider-ID. Daher übernimmt eine benutzerdefinierte Provider-ID, die auf denselben nativen Moonshot-Host verweist, dasselbe Verhalten für Streaming-Nutzungsdaten.Bei den K2.6-Preisen aus dem Katalog wird die gestreamte Nutzung, die Eingabe-, Ausgabe- und Cache-Lese-Tokens enthält, außerdem für /status, /usage full, /usage cost und die sitzungsbezogene Abrechnung auf Grundlage des Transkripts in lokal geschätzte Kosten in USD umgerechnet.
  • Die Kimi-Websuche verwendet KIMI_API_KEY oder MOONSHOT_API_KEY und standardmäßig https://api.moonshot.ai/v1 mit dem Modell kimi-k2.6.
  • Überschreiben Sie bei Bedarf die Preis- und Kontextmetadaten in models.providers.
  • Wenn Moonshot andere Kontextlimits für ein Modell veröffentlicht, passen Sie contextWindow entsprechend an.

Verwandte Themen

Modellauswahl

Auswahl von Providern, Modellreferenzen und Failover-Verhalten.

Websuche

Konfiguration von Websuch-Providern einschließlich Kimi.

Konfigurationsreferenz

Vollständiges Konfigurationsschema für Provider, Modelle und Plugins.

Moonshot Open Platform

Verwaltung und Dokumentation von Moonshot-API-Schlüsseln.