zai met een Z.AI-API-sleutel.
GLM-modellen
GLM is een modelfamilie, geen afzonderlijke provider. In OpenClaw gebruiken GLM-modellen verwijzingen zoalszai/glm-5.2: provider zai, model-id glm-5.2.
Aan de slag
Installeer eerst de provider-Plugin:- Endpoint automatisch detecteren
- Expliciet regionaal endpoint
Het meest geschikt voor: de meeste gebruikers. OpenClaw test ondersteunde Z.AI-endpoints met je API-sleutel en past automatisch de juiste basis-URL toe.
1
Onboarding uitvoeren
2
Controleren of het model wordt vermeld
Endpoints
Z.AI publiceert ook de met Anthropic compatibele Coding Plan-basis-URL
https://api.z.ai/api/anthropic. De Z.AI-keuzes van OpenClaw gebruiken de hierboven gedocumenteerde
OpenAI Chat Completions-endpoints; de Anthropic-URL is bedoeld voor clients die
rechtstreeks met Anthropic Messages communiceren.
zai-api-key detecteert automatisch een van deze vier door je sleutel te testen met de
chat-completions-API van elk endpoint. Daarbij worden eerst de algemene endpoints gecontroleerd
(zai-global, daarna zai-cn) en vervolgens de Coding Plan-endpoints
(zai-coding-global, daarna zai-coding-cn). Het proces stopt bij het eerste endpoint
dat een verzoek accepteert. Gebruik een expliciete --auth-choice om een Coding Plan-endpoint
af te dwingen als je sleutel op beide werkt.
Snelheidslimieten en overbelasting
Z.AI beschrijft Coding Plan en de algemene agenttools als diensten met beheerde capaciteit. Volgens de eigen documentatie van Z.AI:- Algemene agenttools, waaronder OpenClaw, worden op basis van best effort aangeboden. Tijdens een hoge inferentiebelasting, doorgaans rond 14.00-18.00 uur Singaporese tijd, kunnen voor sommige verzoeken tijdelijke snelheidslimieten gelden.
- Snelheids- en gelijktijdigheidslimieten van Coding Plan zijn gekoppeld aan het abonnementsniveau en kunnen dynamisch worden aangepast op basis van de beschikbare resources. Buiten piekuren kan een hogere gelijktijdigheid beschikbaar zijn.
- API-foutcode
1302betekent “Snelheidslimiet voor verzoeken bereikt”. API-foutcode1305betekent “De dienst is mogelijk tijdelijk overbelast. Probeer het later opnieuw”.
429 of 1305 ziet, wacht dan en
probeer het verzoek opnieuw. Als fouten ook buiten piekuren herhaaldelijk optreden of alleen
bij één endpoint, model of verzoekstructuur voorkomen, controleer dan eerst het geconfigureerde endpoint
en model:
https://api.z.ai/api/coding/paas/v4; algemene API-sleutels moeten een algemeen API-endpoint
gebruiken, zoals https://api.z.ai/api/paas/v4. Aanhoudende fouten met dezelfde
sleutel en hetzelfde endpoint kunnen duiden op een weigering door de provider of een abonnementsbeperking,
niet op normale beperking vanwege piekbelasting.
Configuratievoorbeeld
Ingebouwde catalogus
De provider-Pluginzai levert zijn catalogus mee in het Plugin-manifest, zodat een
alleen-lezenlijst bekende GLM-rijen kan weergeven zonder de provider-runtime te laden:
De metadata over tokenkosten in de catalogus volgt de huidige
prijzen voor betalen naar gebruik van Z.AI. Coding Plan-
abonnementen gebruiken een abonnementsquotum in plaats van facturering per token; raadpleeg de actuele
abonnementspagina voor prijzen en beschikbaarheid van abonnementen.
De configuratie van Coding Plan gebruikt standaard
zai/glm-5.2; de configuratie van de algemene API behoudt
zai/glm-5.1. Op de Coding Plan-endpoints valt automatische detectie terug op
glm-5.1 en daarna glm-4.7 wanneer de sleutel of het abonnement GLM-5.2 niet beschikbaar stelt. GLM-
versies en beschikbaarheid kunnen veranderen; voer openclaw models list --all --provider zai uit
om de catalogus te bekijken die je geïnstalleerde versie kent.Denkniveaus
- GLM-5.2
- Andere GLM-modellen
Volledig bereik:
off, low, high, max (standaard off). OpenClaw wijst
low en high toe aan de redeneerinspanning high van Z.AI, en max aan de
inspanning max van Z.AI, via reasoning_effort in de verzoekpayload.off voorkom je antwoorden die het uitvoerbudget besteden aan
reasoning_content vóór zichtbare tekst.
Geavanceerde configuratie
Onbekende GLM-5-modellen voorwaarts oplossen
Onbekende GLM-5-modellen voorwaarts oplossen
Onbekende
glm-5*-id’s worden nog steeds voorwaarts opgelost in het providerpad door
metadata van de provider te genereren op basis van de glm-4.7-sjabloon wanneer de id
overeenkomt met de huidige vorm van de GLM-5-familie.Streaming van toolaanroepen
Streaming van toolaanroepen
tool_stream is standaard ingeschakeld voor streaming van Z.AI-toolaanroepen. Zo schakel je dit uit:Bewaard denkproces
Bewaard denkproces
Het bewaren van het denkproces is opt-in, omdat Z.AI vereist dat de volledige historische
Wanneer dit is ingeschakeld en denken aanstaat, verzendt OpenClaw
reasoning_content opnieuw wordt afgespeeld, waardoor het aantal prompttokens toeneemt. Schakel dit
per model in:thinking: { type: "enabled", clear_thinking: false } en speelt het eerdere
reasoning_content opnieuw af voor hetzelfde met OpenAI compatibele transcript. De snake_case-
parametersleutel preserve_thinking werkt als alias.Geavanceerde gebruikers kunnen de exacte providerpayload nog steeds overschrijven met
params.extra_body.thinking.Beeldbegrip
Beeldbegrip
De Z.AI-Plugin registreert beeldbegrip.
Beeldbegrip wordt automatisch afgeleid uit de geconfigureerde Z.AI-authenticatie —
er is geen aanvullende configuratie nodig.
Authenticatiedetails
Authenticatiedetails
- Z.AI gebruikt Bearer-authenticatie met je API-sleutel.
- De onboardingkeuze
zai-api-keydetecteert automatisch het passende Z.AI-endpoint door ondersteunde endpoints met je sleutel te testen. - Gebruik de expliciete regionale keuzes (
zai-coding-global,zai-coding-cn,zai-global,zai-cn) wanneer je een specifiek API-oppervlak wilt afdwingen. - De verouderde omgevingsvariabele
Z_AI_API_KEYwordt nog steeds geaccepteerd; OpenClaw kopieert deze bij het opstarten naarZAI_API_KEYalsZAI_API_KEYniet is ingesteld.
Gerelateerd
Modelselectie
Providers, modelverwijzingen en failovergedrag kiezen.
Configuratiereferentie
Volledig OpenClaw-configuratieschema, inclusief provider- en modelinstellingen.