zai com uma chave de API da Z.AI.
Modelos GLM
GLM é uma família de modelos, não um provedor separado. No OpenClaw, os modelos GLM usam referências comozai/glm-5.2: provedor zai, ID do modelo glm-5.2.
Introdução
Primeiro, instale o plugin do provedor:- Detecção automática do endpoint
- Endpoint regional explícito
Recomendado para: a maioria dos usuários. O OpenClaw testa os endpoints compatíveis da Z.AI com sua chave de API e aplica automaticamente a URL base correta.
1
Execute a integração inicial
2
Verifique se o modelo está listado
Endpoints
zai-api-key detecta automaticamente um desses quatro, testando sua chave na API
de conclusões de chat de cada endpoint, verificando primeiro os endpoints gerais (zai-global,
depois zai-cn) e, em seguida, os endpoints do Coding Plan (zai-coding-global, depois
zai-coding-cn), e parando no primeiro endpoint que aceitar uma solicitação.
Use uma opção --auth-choice explícita para forçar um endpoint do Coding Plan se sua chave
funcionar em ambos.
Limites de taxa e sobrecargas
A Z.AI documenta o Coding Plan e as ferramentas de agente de uso geral como serviços com capacidade gerenciada. Na documentação da própria Z.AI:- As ferramentas de agente de uso geral, incluindo o OpenClaw, são fornecidas com base no melhor esforço. Durante períodos de alta carga de inferência, normalmente entre 14h e 18h no horário de Singapura, algumas solicitações podem enfrentar limites de taxa temporários.
- Os limites de taxa e simultaneidade do Coding Plan estão vinculados ao nível do plano e podem ser ajustados dinamicamente com base na disponibilidade de recursos. Horários fora de pico podem ter maior simultaneidade.
- O código de erro de API
1302significa “Limite de taxa de solicitações atingido”. O código de erro de API1305significa “O serviço pode estar temporariamente sobrecarregado; tente novamente mais tarde”.
429 ou 1305 durante um período de alta demanda, aguarde e
tente novamente. Se as falhas forem reproduzíveis fora dos períodos de pico ou ocorrerem apenas
com um endpoint, modelo ou formato de solicitação, verifique primeiro o endpoint
e o modelo configurados:
https://api.z.ai/api/coding/paas/v4; as chaves da API geral devem usar um endpoint da API geral,
como https://api.z.ai/api/paas/v4. Falhas persistentes com a mesma
chave e o mesmo endpoint podem indicar uma rejeição do provedor ou uma limitação do plano,
e não uma limitação de taxa normal decorrente de carga de pico.
Exemplo de configuração
Catálogo integrado
O plugin do provedorzai inclui seu catálogo no manifesto do plugin; portanto, a
listagem somente para leitura pode mostrar linhas GLM conhecidas sem carregar o runtime do provedor:
A configuração do Coding Plan usa
zai/glm-5.2 como padrão; a configuração da API geral mantém
zai/glm-5.1. Nos endpoints do Coding Plan, a detecção automática usa como alternativas
glm-5.1 e depois glm-4.7 quando a chave ou o plano não disponibiliza o GLM-5.2. As versões e
a disponibilidade do GLM podem mudar; execute openclaw models list --all --provider zai
para consultar o catálogo conhecido pela versão instalada.Níveis de raciocínio
- GLM-5.2
- Outros modelos GLM
Faixa completa:
off, low, high, max (padrão: off). O OpenClaw mapeia
low e high para o esforço de raciocínio high da Z.AI, e max para o esforço
max da Z.AI, por meio de reasoning_effort no payload da solicitação.off evita respostas que consomem o orçamento de saída com
reasoning_content antes do texto visível.
Configuração avançada
Resolução futura de modelos GLM-5 desconhecidos
Resolução futura de modelos GLM-5 desconhecidos
IDs
glm-5* desconhecidos ainda são resolvidos para versões futuras no caminho do provedor,
sintetizando metadados pertencentes ao provedor a partir do modelo glm-4.7 quando o ID
corresponde ao formato atual da família GLM-5.Streaming de chamadas de ferramentas
Streaming de chamadas de ferramentas
tool_stream é habilitado por padrão para o streaming de chamadas de ferramentas da Z.AI. Para desabilitá-lo:Raciocínio preservado
Raciocínio preservado
O raciocínio preservado é opcional porque a Z.AI exige que todo o histórico de
Quando habilitado e o raciocínio está ativado, o OpenClaw envia
reasoning_content seja reproduzido, o que aumenta os tokens do prompt. Habilite-o
por modelo:thinking: { type: "enabled", clear_thinking: false } e reproduz os
reasoning_content anteriores para a mesma transcrição compatível com a OpenAI. A chave de parâmetro
em snake_case preserve_thinking funciona como alias.Usuários avançados ainda podem substituir o payload exato do provedor com
params.extra_body.thinking.Compreensão de imagens
Compreensão de imagens
O plugin da Z.AI registra a compreensão de imagens.
A compreensão de imagens é resolvida automaticamente com base na autenticação configurada da Z.AI — nenhuma
configuração adicional é necessária.
Detalhes da autenticação
Detalhes da autenticação
- A Z.AI usa autenticação Bearer com sua chave de API.
- A opção de integração inicial
zai-api-keydetecta automaticamente o endpoint correspondente da Z.AI, testando os endpoints compatíveis com sua chave. - Use as opções regionais explícitas (
zai-coding-global,zai-coding-cn,zai-global,zai-cn) quando quiser forçar uma superfície de API específica. - A variável de ambiente legada
Z_AI_API_KEYainda é aceita; o OpenClaw a copia paraZAI_API_KEYna inicialização seZAI_API_KEYnão estiver definida.
Relacionados
Seleção de modelos
Escolha de provedores, referências de modelos e comportamento de failover.
Referência de configuração
Esquema completo de configuração do OpenClaw, incluindo configurações de provedores e modelos.