xai integrado para modelos Grok. O
caminho recomendado é o OAuth do Grok com uma assinatura elegível do SuperGrok ou X Premium.
Gateway, configuração, roteamento e ferramentas permanecem locais; somente as solicitações do Grok
são enviadas à API da xAI.
O OAuth não exige uma chave de API da xAI nem o aplicativo Grok Build. A xAI ainda pode
exibir o Grok Build na tela de consentimento porque o OpenClaw usa o cliente OAuth
compartilhado da xAI.
Configuração
1
Nova instalação
Execute a integração inicial com a instalação do daemon e selecione o OAuth da xAI/Grok na
etapa de modelo/autenticação:Em um VPS ou via SSH, selecione diretamente o OAuth da xAI; ele usa a verificação
por código de dispositivo e não precisa de um callback de localhost:
2
Instalação existente
Entre somente na xAI; não execute novamente toda a integração inicial apenas para conectar o Grok:Defina o Grok como modelo padrão separadamente:Execute novamente toda a integração inicial somente se quiser alterar intencionalmente o Gateway,
daemon, canal, espaço de trabalho ou outras opções de configuração.
3
Caminho com chave de API
A configuração por chave de API ainda funciona para chaves do xAI Console e para recursos de mídia
que precisam de configuração de provedor baseada em chave:
4
Escolha um modelo
O OpenClaw usa a API Responses da xAI como transporte integrado da xAI. A mesma
credencial de
openclaw models auth login --provider xai --method oauth ou
--method api-key também alimenta web_search (id do provedor grok), x_search,
code_execution, fala/transcrição e geração de imagens/vídeos da xAI. Se uma
chave da xAI for armazenada em plugins.entries.xai.config.webSearch.apiKey, o
provedor de modelos da xAI integrado também a reutilizará como alternativa.Solução de problemas do OAuth
-
Para SSH, Docker, VPS ou outras configurações remotas, use
openclaw models auth login --provider xai --method oauth; ele usa verificação por código de dispositivo, não um callback de localhost. -
Se a entrada for bem-sucedida, mas o Grok não for o modelo padrão, execute
openclaw models set xai/grok-4.3. -
Inspecione os perfis de autenticação da xAI salvos:
- A xAI decide quais contas podem receber tokens de API OAuth. Se uma conta não for elegível, use o caminho com chave de API ou verifique a assinatura na xAI.
Catálogo integrado
IDs selecionáveis nos seletores de modelo. O Plugin ainda resolve IDs mais antigos do Grok 3, Grok 4, Grok 4 Fast, Grok 4.1 Fast e Grok Code para configurações existentes; consulte compatibilidade legada e aliases móveis.Cobertura de recursos
O Plugin integrado mapeia as APIs compatíveis da xAI para os contratos compartilhados de provedor e ferramentas do OpenClaw. Os recursos que não se encaixam no contrato compartilhado estão listados abaixo ou nas limitações conhecidas.O OpenClaw usa as APIs REST de imagem/vídeo/TTS/STT da xAI para geração de mídia e
transcrição em lote, o WebSocket de STT por streaming da xAI para transcrição de chamadas
de voz ao vivo, o WebSocket do Grok Voice Agent da xAI para sessões Talk em tempo real
e a API Responses para chat, pesquisa e ferramentas de execução de código.
Compatibilidade legada do modo rápido
/fast on ou agents.defaults.models["xai/<model>"].params.fastMode: true
ainda reescreve configurações mais antigas da xAI da seguinte forma. Esses IDs de destino são
mantidos apenas para compatibilidade; use os modelos selecionáveis atuais em novas
configurações.
Compatibilidade legada e aliases móveis
Aliases mais antigos são normalizados da seguinte forma:
Os IDs 0309 datados são as entradas selecionáveis do catálogo. O OpenClaw envia todos os outros
aliases atuais do Grok 4.20 literalmente para que a xAI mantenha o controle da semântica dos aliases
estáveis, mais recentes, beta, experimentais e datados. O alias global
grok-latest também é
preservado literalmente.
A xAI descontinuou os seguintes IDs exatos. O OpenClaw os mantém como linhas de compatibilidade
ocultas para configurações já distribuídas, com os limites e preços de seus destinos de
redirecionamento atuais:
openclaw doctor --fix atualiza os padrões persistidos das ferramentas de servidor da xAI e o
slug descontinuado de imagem de qualidade, remove linhas obsoletas do catálogo gerado e corrige
metadados de contexto obsoletos em linhas 4.20 ativas. Ele não fixa os aliases
beta-latest ativos do 4.20 em um snapshot datado.
Recursos
Pesquisa web
Pesquisa web
O provedor integrado de pesquisa web
grok prioriza o OAuth da xAI e, em seguida, usa como alternativa
XAI_API_KEY ou uma chave de pesquisa web do Plugin:Geração de vídeos
Geração de vídeos
O Plugin integrado
xai registra a geração de vídeos por meio da ferramenta
compartilhada video_generate.- Modelo padrão:
xai/grok-imagine-video - Modelo adicional:
xai/grok-imagine-video-1.5 - Modos clássicos: texto para vídeo, imagem para vídeo, geração com imagem de referência, edição remota de vídeo e extensão remota de vídeo
- Modo Video 1.5: somente imagem para vídeo, com exatamente uma imagem de primeiro quadro
- Proporções:
1:1,16:9,9:16,4:3,3:4,3:2,2:3; a conversão de imagem para vídeo clássica e do Video 1.5 herda a proporção da imagem de origem quando omitida - Resoluções: clássica
480P/720P; o Video 1.5 também aceita1080P; todos os modos de geração usam480Pcomo padrão - Duração: 1-15 segundos para geração/imagem para vídeo, 1-10 segundos ao
usar funções clássicas
reference_image, 2-10 segundos para extensão clássica - Geração com imagem de referência: defina
imageRolescomoreference_imagepara cada imagem fornecida; a xAI aceita até 7 dessas imagens - A edição/extensão de vídeo herda a proporção e a resolução do vídeo de entrada; essas operações não aceitam substituições de geometria
- Tempo limite padrão da operação: 600 segundos, a menos que
video_generate.timeoutMsouagents.defaults.videoGenerationModel.timeoutMsesteja definido
grok-imagine-video-1.5-preview e
grok-imagine-video-1.5-2026-05-30 da xAI. O OpenClaw encaminha o
identificador selecionado sem alterações, mas aplica a mesma validação exclusiva para imagens.Para usar a xAI como provedor de vídeo padrão:Consulte Geração de vídeos para conhecer os parâmetros compartilhados da
ferramenta, a seleção de provedor e o comportamento de failover.
Geração de imagens
Geração de imagens
O Plugin integrado
xai registra a geração de imagens por meio da ferramenta
compartilhada image_generate.- Modelo de imagem padrão:
xai/grok-imagine-image - Modelo adicional:
xai/grok-imagine-image-quality - Modos: texto para imagem e edição de imagem de referência
- Entradas de referência: uma
imageou até trêsimages - Proporções:
1:1,16:9,9:16,4:3,3:4,3:2,2:3,2:1,1:2,19.5:9,9:19.5,20:9,9:20 - Resoluções:
1K,2K - Quantidade: até 4 imagens
- Tempo limite padrão da operação: 600 segundos, a menos que
image_generate.timeoutMsouagents.defaults.imageGenerationModel.timeoutMsesteja definido
b64_json para que a mídia gerada possa ser
armazenada e entregue pelo caminho normal de anexos do canal. Imagens de
referência locais são convertidas em URLs de dados; referências remotas http(s)
são encaminhadas sem alterações.Para usar a xAI como provedor de imagens padrão:A xAI também documenta
quality, mask, user e uma proporção auto.
Atualmente, o OpenClaw encaminha apenas os controles de imagem compartilhados entre provedores;
essas opções exclusivas do provedor nativo não são expostas por meio de image_generate.Conversão de texto em fala
Conversão de texto em fala
O Plugin integrado
xai registra a conversão de texto em fala por meio da superfície
compartilhada do provedor tts.- Vozes: catálogo autenticado em tempo real da xAI; liste-o com
openclaw infer tts voices --provider xai - Vozes alternativas offline:
ara,eve,leo,rex,sal - Voz padrão:
eve - IDs de vozes personalizadas da conta são encaminhados mesmo quando estão ausentes da resposta do catálogo integrado
- Formatos:
mp3,wav,pcm,mulaw,alaw - Idioma: código BCP-47 ou
auto - Velocidade: substituição de velocidade nativa do provedor
- O formato nativo Opus de mensagem de voz não é compatível
O OpenClaw usa o endpoint em lote
/v1/tts da xAI para síntese com buffer,
a descoberta autenticada do catálogo /v1/tts/voices e o recurso nativo
wss://api.x.ai/v1/tts para síntese por streaming. O streaming é restrito ao
host nativo api.x.ai, portanto valores personalizados de baseUrl são rejeitados nesse
caminho. Ele usa os controles existentes de idioma, voz, codec e velocidade; os
padrões da xAI são aplicados à taxa de amostragem e à taxa de bits. A síntese de arquivos
de áudio respeita todos os codecs configurados. Destinos de mensagens de voz usam MP3 para streaming e
alternativa com buffer porque os codecs brutos da xAI não contêm metadados de codec/taxa. O
stream envia text.delta e depois
text.done, recebe audio.delta, audio.done ou error e aplica um
timeoutMs de inatividade que é renovado a cada bloco de áudio. Ele é separado das
sessões de voz em tempo real. Consulte o contrato da API de TTS por streaming da xAI.Conversão de fala em texto
Conversão de fala em texto
O Plugin integrado O idioma pode ser fornecido pela configuração compartilhada de mídia de áudio ou pela solicitação
de transcrição de cada chamada. Dicas de prompt são aceitas pela superfície compartilhada do
OpenClaw, mas a integração REST de STT da xAI encaminha apenas o arquivo e o idioma
porque eles correspondem ao endpoint público atual da xAI.
xai registra a conversão de fala em texto em lote por meio da
superfície de transcrição para compreensão de mídia do OpenClaw.- Endpoint: REST da xAI
/v1/stt - Caminho de entrada: upload de arquivo de áudio multipart
- Seleção de modelo: a xAI escolhe o modelo de transcrição internamente; o endpoint não tem seletor de modelo
- Usado sempre que a transcrição de áudio recebido lê
tools.media.audio, incluindo segmentos de canais de voz do Discord e anexos de áudio dos canais
Conversão de fala em texto por streaming
Conversão de fala em texto por streaming
O Plugin integrado A configuração pertencente ao provedor fica em
xai também registra um provedor de transcrição em tempo real
para áudio de chamadas de voz ao vivo.- Endpoint: WebSocket da xAI
wss://api.x.ai/v1/stt - Codificação padrão:
mulaw - Taxa de amostragem padrão:
8000 - Detecção de fim de fala padrão:
800ms - Transcrições provisórias: ativadas por padrão
plugins.entries.voice-call.config.streaming.providers.xai. As chaves
compatíveis são apiKey, baseUrl, sampleRate, encoding (pcm, mulaw ou
alaw), interimResults, endpointingMs e language.Este provedor de streaming se destina ao caminho de transcrição em tempo real do Voice Call.
A voz do Discord grava segmentos curtos e usa o caminho de transcrição em lote
tools.media.audio.Voz em tempo real (Talk)
Voz em tempo real (Talk)
O Plugin integrado A configuração pertencente ao provedor também é resolvida de
xai registra sessões em tempo real do Grok Voice Agent para
o modo Talk por meio do contrato compartilhado registerRealtimeVoiceProvider.- Endpoint:
wss://api.x.ai/v1/realtime?model=<voice-model> - Modelo padrão:
grok-voice-latest - Voz padrão:
eve - Transporte:
gateway-relay(caminhos de retransmissão do iOS, Android e Control UI) - Áudio: PCM16 24 kHz ou G.711 µ-law 8 kHz
- Interrupção: o VAD do servidor da xAI interrompe a resposta; o OpenClaw limpa a reprodução na fila e trunca o histórico não reproduzido do provedor
plugins.entries.voice-call.config.realtime.providers.xai quando o Voice Call
ou seletores compartilhados em tempo real reutilizam o mesmo mapa de provedores. As chaves compatíveis são
apiKey, baseUrl, model, voice, vadThreshold, silenceDurationMs,
prefixPaddingMs, reasoningEffort e sessionResumption.
reasoningEffort aceita apenas high ou none, de acordo com a API Voice Agent da xAI.O VAD do servidor da xAI sempre cria respostas e processa interrupções de áudio.
Use consultRouting: "provider-direct"; o roteamento forçado de transcrições e a desativação
da interrupção do áudio de entrada não são compatíveis com o protocolo Voice Agent da xAI.O OAuth da xAI ou
XAI_API_KEY pode autenticar a voz em tempo real. O WebRTC controlado
pelo navegador ainda não faz parte dessa superfície do provedor; use o Talk com retransmissão pelo Gateway em
Nodes nativos ou o caminho de retransmissão da Control UI.sessionResumption usa false como padrão. Quando definido como true, o OpenClaw solicita
à xAI que mantenha estado suficiente da sessão para retomar a mesma conversa após uma
reconexão e, em seguida, reconecta usando o ID de conversa retornado. Mantenha-o
desativado quando a reprodução/retenção no lado do provedor não for aceitável; nesse caso, soquetes
interrompidos falham de forma fechada, em vez de iniciar silenciosamente uma nova conversa.Configuração do x_search
Configuração do x_search
O Plugin integrado da xAI expõe
x_search como uma ferramenta do OpenClaw para
pesquisar conteúdo do X (antigo Twitter) por meio do Grok.Caminho da configuração: plugins.entries.xai.config.xSearchConfiguração da execução de código
Configuração da execução de código
O Plugin integrado da xAI expõe
code_execution como uma ferramenta do OpenClaw para
execução remota de código no ambiente de sandbox da xAI.Caminho da configuração: plugins.entries.xai.config.codeExecutionEsta é uma execução remota no sandbox da xAI, não uma execução local de
exec.Limitações conhecidas
Limitações conhecidas
- A autenticação da xAI pode usar uma chave de API, variável de ambiente, fallback de configuração de plugin ou OAuth com uma conta xAI elegível. O OAuth usa verificação por código de dispositivo sem um callback de localhost. A xAI decide quais contas podem receber tokens de API OAuth, e a página de consentimento pode exibir o Grok Build, embora o OpenClaw não exija o aplicativo Grok Build.
- Atualmente, o OpenClaw não disponibiliza a família de modelos multiagente da xAI. A xAI fornece esses modelos por meio da Responses API, mas eles não aceitam as ferramentas do lado do cliente ou personalizadas usadas pelo loop de agente compartilhado do OpenClaw. Consulte as limitações dos modelos multiagente da xAI.
- Atualmente, a voz em tempo real da xAI disponibiliza apenas o transporte de conversação por retransmissão do Gateway. As sessões WebSocket do provedor controladas pelo navegador ainda não estão integradas à interface de controle.
- A imagem
quality, a imagemmaske as proporções adicionais exclusivas do modo nativo não são disponibilizadas até que a ferramenta compartilhadaimage_generatetenha controles correspondentes entre provedores.
Notas avançadas
Notas avançadas
- O OpenClaw aplica automaticamente correções de compatibilidade específicas da xAI para esquemas e chamadas de ferramentas no caminho compartilhado do executor.
- As solicitações nativas da xAI usam
tool_stream: truepor padrão. Definaagents.defaults.models["xai/<model>"].params.tool_streamcomofalsepara desativá-lo. - O wrapper integrado da xAI remove limites de contagem de ocorrências não compatíveis nos esquemas
e chaves de carga útil de esforço de raciocínio não compatíveis antes de enviar solicitações
nativas da xAI. O Grok 4.5 oferece suporte a esforço baixo, médio e
alto (padrão: alto). O Grok 4.3 oferece suporte a esforço nenhum, baixo, médio e alto
(padrão: baixo). Outros modelos da xAI com capacidade de raciocínio não disponibilizam um
controle de esforço configurável, mas ainda solicitam
include: ["reasoning.encrypted_content"]para que o raciocínio criptografado anterior possa ser reproduzido em interações subsequentes. web_search,x_searchecode_executionsão disponibilizados como ferramentas do OpenClaw. O OpenClaw anexa à solicitação de cada ferramenta somente o recurso integrado específico da xAI necessário para ela, em vez de anexar todas as ferramentas nativas a cada interação do chat.- O
web_searchdo Grok lêplugins.entries.xai.config.webSearch.baseUrl.x_searchlêplugins.entries.xai.config.xSearch.baseUrle, em seguida, usa como alternativa a URL base de pesquisa na web do Grok. x_searchecode_executionpertencem ao plugin integrado da xAI, em vez de serem codificados diretamente no runtime principal do modelo.code_executioné uma execução remota no sandbox da xAI, não uma execução local deexec.
Testes em ambiente real
Os caminhos de mídia da xAI são cobertos por testes de unidade e suítes ao vivo opcionais. ExporteXAI_API_KEY no ambiente do processo antes de executar as verificações ao vivo.
Relacionados
Seleção de modelos
Escolha de provedores, referências de modelos e comportamento de failover.
Geração de vídeo
Parâmetros compartilhados da ferramenta de vídeo e seleção de provedor.
Todos os provedores
Uma visão geral mais ampla dos provedores.
Solução de problemas
Problemas comuns e correções.