zai avec une clé d’API Z.AI.
Modèles GLM
GLM est une famille de modèles, et non un fournisseur distinct. Dans OpenClaw, les modèles GLM utilisent des références telles quezai/glm-5.2 : fournisseur zai, identifiant de modèle glm-5.2.
Bien démarrer
Installez d’abord le Plugin du fournisseur :- Détection automatique du point de terminaison
- Point de terminaison régional explicite
Idéal pour : la plupart des utilisateurs. OpenClaw teste les points de terminaison Z.AI pris en charge avec votre clé d’API et applique automatiquement l’URL de base correcte.
1
Exécuter l’intégration initiale
2
Vérifier que le modèle figure dans la liste
Points de terminaison
zai-api-key détecte automatiquement l’un de ces quatre points de terminaison en testant votre clé auprès de l’API
de complétions de chat de chacun d’eux. Il vérifie les points de terminaison généraux (zai-global,
puis zai-cn) avant ceux de Coding Plan (zai-coding-global, puis
zai-coding-cn) et s’arrête au premier point de terminaison qui accepte une requête.
Utilisez un --auth-choice explicite pour imposer un point de terminaison Coding Plan si votre clé
fonctionne avec les deux.
Limites de débit et surcharges
La documentation de Z.AI décrit Coding Plan et les outils d’agent polyvalents comme des services à capacité gérée. Selon la documentation de Z.AI :- Les outils d’agent polyvalents, notamment OpenClaw, sont fournis dans la mesure du possible. Lors des fortes charges d’inférence, généralement entre 14 h et 18 h, heure de Singapour, certaines requêtes peuvent être soumises à des limites de débit temporaires.
- Les limites de débit et de concurrence de Coding Plan dépendent du niveau du forfait et peuvent être ajustées dynamiquement en fonction de la disponibilité des ressources. La concurrence peut être plus élevée pendant les heures creuses.
- Le code d’erreur d’API
1302signifie « Limite de débit atteinte pour les requêtes ». Le code d’erreur d’API1305signifie « Le service est peut-être temporairement surchargé. Veuillez réessayer ultérieurement ».
429 ou 1305 pendant une période de forte activité, attendez et
réessayez la requête. Si les échecs se reproduisent en dehors des périodes de pointe ou ne
concernent qu’un point de terminaison, un modèle ou une forme de requête, vérifiez d’abord le point de terminaison
et le modèle configurés :
https://api.z.ai/api/coding/paas/v4 ; les clés d’API générales doivent utiliser un point de terminaison d’API générale
tel que https://api.z.ai/api/paas/v4. Des échecs persistants avec la
même clé et le même point de terminaison peuvent indiquer un rejet côté fournisseur ou une limitation du forfait,
et non une limitation ordinaire due aux pics de charge.
Exemple de configuration
Catalogue intégré
Le Plugin du fournisseurzai fournit son catalogue dans le manifeste du Plugin ; l’affichage
en lecture seule peut donc présenter les entrées GLM connues sans charger l’environnement d’exécution du fournisseur :
La configuration de Coding Plan utilise
zai/glm-5.2 par défaut ; celle de l’API générale conserve
zai/glm-5.1. Sur les points de terminaison Coding Plan, la détection automatique se rabat sur
glm-5.1, puis sur glm-4.7 lorsque la clé ou le forfait ne donne pas accès à GLM-5.2. Les versions
et la disponibilité de GLM peuvent changer ; exécutez openclaw models list --all --provider zai
pour afficher le catalogue connu de votre version installée.Niveaux de raisonnement
- GLM-5.2
- Autres modèles GLM
Plage complète :
off, low, high, max (off par défaut). OpenClaw associe
low et high à l’effort de raisonnement high de Z.AI, et max à
l’effort max de Z.AI, via reasoning_effort dans la charge utile de la requête.off évite les réponses qui consacrent le budget de sortie à
reasoning_content avant le texte visible.
Configuration avancée
Résolution anticipée des modèles GLM-5 inconnus
Résolution anticipée des modèles GLM-5 inconnus
Les identifiants
glm-5* inconnus continuent d’être résolus sur le chemin du fournisseur en
synthétisant les métadonnées détenues par le fournisseur à partir du modèle glm-4.7 lorsque l’identifiant
correspond à la forme actuelle de la famille GLM-5.Diffusion en continu des appels d’outils
Diffusion en continu des appels d’outils
tool_stream est activé par défaut pour la diffusion en continu des appels d’outils Z.AI. Pour le désactiver :Raisonnement conservé
Raisonnement conservé
Le raisonnement conservé est facultatif, car Z.AI exige de rejouer l’intégralité de l’historique
Lorsqu’il est activé et que le raisonnement est en fonctionnement, OpenClaw envoie
reasoning_content, ce qui augmente le nombre de jetons de l’invite. Activez-le
pour chaque modèle :thinking: { type: "enabled", clear_thinking: false } et rejoue les éléments
reasoning_content précédents pour la même transcription compatible avec OpenAI. La clé de paramètre en snake_case
preserve_thinking fonctionne comme alias.Les utilisateurs avancés peuvent toujours remplacer la charge utile exacte du fournisseur avec
params.extra_body.thinking.Compréhension des images
Compréhension des images
Le Plugin Z.AI enregistre la compréhension des images.
La compréhension des images est automatiquement résolue à partir de l’authentification Z.AI configurée — aucune
configuration supplémentaire n’est nécessaire.
Détails de l’authentification
Détails de l’authentification
- Z.AI utilise l’authentification Bearer avec votre clé d’API.
- L’option d’intégration initiale
zai-api-keydétecte automatiquement le point de terminaison Z.AI correspondant en testant les points de terminaison pris en charge avec votre clé. - Utilisez les options régionales explicites (
zai-coding-global,zai-coding-cn,zai-global,zai-cn) lorsque vous souhaitez imposer une surface d’API précise. - L’ancienne variable d’environnement
Z_AI_API_KEYest toujours acceptée ; OpenClaw la copie dansZAI_API_KEYau démarrage siZAI_API_KEYn’est pas définie.
Pages connexes
Sélection du modèle
Choix des fournisseurs, des références de modèles et du comportement de basculement.
Référence de configuration
Schéma de configuration complet d’OpenClaw, y compris les paramètres des fournisseurs et des modèles.