Skip to main content
Z.AI é a plataforma de API para modelos GLM. Ela fornece APIs REST para GLM e usa chaves de API para autenticação. Crie sua chave de API no console da Z.AI. O OpenClaw usa o provedor zai com uma chave de API da Z.AI.

Modelos GLM

GLM é uma família de modelos, não um provedor separado. No OpenClaw, os modelos GLM usam referências como zai/glm-5.2: provedor zai, ID do modelo glm-5.2.

Introdução

Primeiro, instale o plugin do provedor:
Recomendado para: a maioria dos usuários. O OpenClaw testa os endpoints compatíveis da Z.AI com sua chave de API e aplica automaticamente a URL base correta.
1

Execute a integração inicial

2

Verifique se o modelo está listado

Endpoints

zai-api-key detecta automaticamente um desses quatro, testando sua chave na API de conclusões de chat de cada endpoint, verificando primeiro os endpoints gerais (zai-global, depois zai-cn) e, em seguida, os endpoints do Coding Plan (zai-coding-global, depois zai-coding-cn), e parando no primeiro endpoint que aceitar uma solicitação. Use uma opção --auth-choice explícita para forçar um endpoint do Coding Plan se sua chave funcionar em ambos.

Limites de taxa e sobrecargas

A Z.AI documenta o Coding Plan e as ferramentas de agente de uso geral como serviços com capacidade gerenciada. Na documentação da própria Z.AI:
  • As ferramentas de agente de uso geral, incluindo o OpenClaw, são fornecidas com base no melhor esforço. Durante períodos de alta carga de inferência, normalmente entre 14h e 18h no horário de Singapura, algumas solicitações podem enfrentar limites de taxa temporários.
  • Os limites de taxa e simultaneidade do Coding Plan estão vinculados ao nível do plano e podem ser ajustados dinamicamente com base na disponibilidade de recursos. Horários fora de pico podem ter maior simultaneidade.
  • O código de erro de API 1302 significa “Limite de taxa de solicitações atingido”. O código de erro de API 1305 significa “O serviço pode estar temporariamente sobrecarregado; tente novamente mais tarde”.
Se receber uma resposta temporária 429 ou 1305 durante um período de alta demanda, aguarde e tente novamente. Se as falhas forem reproduzíveis fora dos períodos de pico ou ocorrerem apenas com um endpoint, modelo ou formato de solicitação, verifique primeiro o endpoint e o modelo configurados:
As chaves do Coding Plan devem usar um endpoint do Coding Plan, como https://api.z.ai/api/coding/paas/v4; as chaves da API geral devem usar um endpoint da API geral, como https://api.z.ai/api/paas/v4. Falhas persistentes com a mesma chave e o mesmo endpoint podem indicar uma rejeição do provedor ou uma limitação do plano, e não uma limitação de taxa normal decorrente de carga de pico.

Exemplo de configuração

zai-api-key permite que o OpenClaw detecte pela chave o endpoint correspondente da Z.AI e aplique automaticamente a URL base correta. Use as opções regionais explícitas quando quiser forçar um Coding Plan específico ou uma superfície de API geral.

Catálogo integrado

O plugin do provedor zai inclui seu catálogo no manifesto do plugin; portanto, a listagem somente para leitura pode mostrar linhas GLM conhecidas sem carregar o runtime do provedor:
O catálogo baseado no manifesto inclui atualmente:
Os modelos GLM estão disponíveis como zai/<model> (exemplo: zai/glm-5).
A configuração do Coding Plan usa zai/glm-5.2 como padrão; a configuração da API geral mantém zai/glm-5.1. Nos endpoints do Coding Plan, a detecção automática usa como alternativas glm-5.1 e depois glm-4.7 quando a chave ou o plano não disponibiliza o GLM-5.2. As versões e a disponibilidade do GLM podem mudar; execute openclaw models list --all --provider zai para consultar o catálogo conhecido pela versão instalada.

Níveis de raciocínio

Faixa completa: off, low, high, max (padrão: off). O OpenClaw mapeia low e high para o esforço de raciocínio high da Z.AI, e max para o esforço max da Z.AI, por meio de reasoning_effort no payload da solicitação.
Definir o raciocínio como off evita respostas que consomem o orçamento de saída com reasoning_content antes do texto visível.

Configuração avançada

IDs glm-5* desconhecidos ainda são resolvidos para versões futuras no caminho do provedor, sintetizando metadados pertencentes ao provedor a partir do modelo glm-4.7 quando o ID corresponde ao formato atual da família GLM-5.
tool_stream é habilitado por padrão para o streaming de chamadas de ferramentas da Z.AI. Para desabilitá-lo:
O raciocínio preservado é opcional porque a Z.AI exige que todo o histórico de reasoning_content seja reproduzido, o que aumenta os tokens do prompt. Habilite-o por modelo:
Quando habilitado e o raciocínio está ativado, o OpenClaw envia thinking: { type: "enabled", clear_thinking: false } e reproduz os reasoning_content anteriores para a mesma transcrição compatível com a OpenAI. A chave de parâmetro em snake_case preserve_thinking funciona como alias.Usuários avançados ainda podem substituir o payload exato do provedor com params.extra_body.thinking.
O plugin da Z.AI registra a compreensão de imagens.A compreensão de imagens é resolvida automaticamente com base na autenticação configurada da Z.AI — nenhuma configuração adicional é necessária.
  • A Z.AI usa autenticação Bearer com sua chave de API.
  • A opção de integração inicial zai-api-key detecta automaticamente o endpoint correspondente da Z.AI, testando os endpoints compatíveis com sua chave.
  • Use as opções regionais explícitas (zai-coding-global, zai-coding-cn, zai-global, zai-cn) quando quiser forçar uma superfície de API específica.
  • A variável de ambiente legada Z_AI_API_KEY ainda é aceita; o OpenClaw a copia para ZAI_API_KEY na inicialização se ZAI_API_KEY não estiver definida.

Relacionados

Seleção de modelos

Escolha de provedores, referências de modelos e comportamento de failover.

Referência de configuração

Esquema completo de configuração do OpenClaw, incluindo configurações de provedores e modelos.