Skip to main content
OpenClaw usa un único id de proveedor, openai, tanto para la autenticación directa con clave de API como para la autenticación mediante suscripción de ChatGPT/Codex. openai/* es la ruta de modelo canónica. Para los turnos del agente integrado cuya política de runtime no esté definida o sea auto, los datos de ruta de OpenAI determinan si OpenClaw puede seleccionar implícitamente el runtime incluido del servidor de aplicaciones de Codex. El prefijo openai/* por sí solo no selecciona ningún runtime.
  • Modelos de agente - openai/* mediante el runtime seleccionado por la configuración explícita agentRuntime o por la política de ruta implícita de OpenAI. Inicie sesión con la autenticación de Codex para usar una suscripción de ChatGPT/Codex, o configure un perfil de autenticación con clave de API si desea facturación basada en claves.
  • API de OpenAI ajenas al agente - acceso directo a OpenAI Platform, facturado por uso, mediante OPENAI_API_KEY o un perfil de autenticación con clave de API openai.
  • Configuración heredada - las referencias codex/* y openai-codex/* se reparan como openai/* más agentRuntime.id: "codex" con ámbito de modelo mediante openclaw doctor --fix.
OpenAI admite explícitamente el uso de OAuth de suscripción en herramientas y flujos de trabajo externos como OpenClaw.

Seguimiento del uso y los costes

OpenClaw mantiene separados la cuota de suscripción y la facturación de la API de Platform:
  • OAuth de ChatGPT/Codex muestra el plan de suscripción, los períodos de cuota y el saldo de créditos.
  • OPENAI_ADMIN_KEY muestra 30 días de costes de la organización y uso de completions informados por el proveedor en Uso de Control UI, incluidos el gasto diario, los totales de solicitudes/tokens, los modelos principales y las categorías de costes.
  • OPENAI_PROJECT_ID limita opcionalmente el historial de la Admin API a un proyecto.
  • OpenClaw nunca envía OPENAI_API_KEY ni un perfil de inferencia openai a las API de la organización; esas credenciales pueden pertenecer a endpoints personalizados, de Azure o locales del agente.
Una clave de administración explícita tiene prioridad sobre OAuth. El historial informado por el proveedor no se combina con el coste estimado por OpenClaw a partir de las sesiones; puede incluir actividad de la API procedente de otros clientes y ajustes de facturación del proveedor. La documentación del panel de uso de la API de OpenAI describe los requisitos de ser propietario de la organización y contar con permisos explícitos del Usage Dashboard para acceder a los datos de uso. El proveedor, el modelo, el runtime y el canal son capas independientes. Si esas etiquetas se están confundiendo, consulte Runtimes de agente antes de cambiar la configuración.

Elección rápida

Mapa de nombres

Runtime implícito del agente

Cuando la política agentRuntime del proveedor/modelo no está definida o es auto, la política de ruta propiedad del proveedor de OpenAI elige el runtime implícito a partir del endpoint y el adaptador efectivos: Una configuración agentRuntime.id explícita y no predeterminada del proveedor/modelo sigue siendo vinculante. Por ejemplo, agentRuntime.id: "openclaw" mantiene en OpenClaw una ruta que, de otro modo, sería apta para Codex, mientras que agentRuntime.id: "codex" exige Codex y falla de forma cerrada cuando la ruta efectiva no está declarada como compatible con Codex. La selección del runtime no cambia el tipo de credencial ni la facturación: la autenticación con clave de API de Platform y la autenticación mediante suscripción de ChatGPT/Codex siguen siendo distintas. openclaw doctor --fix migra las referencias de modelo heredadas codex/* y openai-codex/*, los ids de perfil de autenticación de Codex heredados y las entradas de orden de autenticación de Codex heredadas a la ruta canónica openai. Las referencias de modelo migradas reciben agentRuntime.id: "codex" con ámbito de modelo; use auth.order.openai para las nuevas configuraciones de orden de autenticación.
La configuración nueva de OpenAI solo aplica un modelo principal GPT-5.6 cuando no hay ningún modelo principal configurado. Añadir o actualizar la autenticación de OpenAI conserva cualquier selección explícita existente, incluida openai/gpt-5.5, salvo que se use explícitamente models auth login --set-default o models set. Use un perfil de autenticación con clave de API solo cuando desee autenticación mediante clave de API para un modelo de agente.

Vista previa limitada de GPT-5.6

OpenClaw reconoce los ids de modelo exactos openai/gpt-5.6-sol, openai/gpt-5.6-terra y openai/gpt-5.6-luna. Los tres ofrecen los niveles de razonamiento xhigh y max en el catálogo actual. OpenAI describe Sol como el nivel insignia, Terra como el nivel equilibrado y Luna como el nivel rápido y de menor coste. Consulte el anuncio de lanzamiento de GPT-5.6 y la guía de acceso. Con autenticación directa mediante clave de API de OpenAI, el id básico openai/gpt-5.6 es un alias de Sol y el valor predeterminado de la configuración nueva. El catálogo nativo de Codex no aplica ese alias de API directa en el cliente; según el acceso del espacio de trabajo, puede mostrar los ids exactos de Sol, Terra y Luna. Por tanto, la configuración nueva de OAuth de ChatGPT/Codex usa openai/gpt-5.6-sol. Compruebe la cuenta actual con:
El acceso de la organización de la API y el del espacio de trabajo de Codex pueden ser diferentes. Si GPT-5.6 no está disponible, seleccione GPT-5.5 explícitamente:
OpenClaw muestra el error de acceso original y no sustituye silenciosamente una selección de GPT-5.6 por GPT-5.5.
Las rutas HTTPS oficiales exactas que cumplan los requisitos pueden seleccionar el Plugin incluido del servidor de aplicaciones de Codex cuando la política del runtime no está definida o es auto; las rutas de Completions definidas, los endpoints personalizados y las anulaciones del transporte de solicitudes permanecen en OpenClaw. Los endpoints HTTP oficiales sin cifrar se rechazan. La configuración explícita del runtime del proveedor/modelo sigue siendo vinculante. Ejecute openclaw doctor --fix para reparar referencias de modelo de Codex heredadas y obsoletas, referencias codex-cli/* o asignaciones antiguas de sesiones de runtime que no se establecieron mediante una configuración explícita del runtime.

Cobertura de funciones de OpenClaw

La voz en tiempo real de OpenAI pasa por la API Realtime pública de OpenAI Platform y requiere una clave de API de Platform. En cambio, los tokens OAuth de Codex autentican el backend de ChatGPT Codex; no son intercambiables con las claves de API de Platform para los endpoints públicos de Realtime.Si la autenticación mediante clave de API informa que falta facturación, recargue los créditos de Platform en platform.openai.com/account/billing para la organización que respalda sus credenciales de tiempo real cuando utilice la autenticación mediante clave de API. La voz en tiempo real acepta el perfil de autenticación mediante clave de API openai creado por openclaw onboard --auth-choice openai-api-key, una clave de API de Platform establecida mediante talk.realtime.providers.openai.apiKey para Control UI Talk, o plugins.entries.voice-call.config.realtime.providers.openai.apiKey para Voice Call, o la variable de entorno OPENAI_API_KEY.En Control UI Video Talk, OpenAI WebRTC recibe el contexto de la cámara bajo demanda: cuando el modelo llama a describe_view, el navegador envía un único JPEG de tamaño limitado por el canal de datos en tiempo real. OpenClaw no adjunta una pista continua de la cámara a la sesión de OpenAI.

Embeddings de memoria

OpenClaw puede utilizar OpenAI, o un endpoint de embeddings compatible con OpenAI, para la indexación de memory_search y los embeddings de consultas:
Para los endpoints compatibles con OpenAI que requieran etiquetas de embeddings asimétricas, establezca queryInputType y documentInputType en memory.search. OpenClaw los reenvía como campos de solicitud input_type específicos del proveedor: los embeddings de consultas utilizan queryInputType; los fragmentos de memoria indexados y la indexación por lotes utilizan documentInputType. Consulte la referencia de configuración de memoria para ver el ejemplo completo.

Primeros pasos

Ideal para: acceso directo a la API y facturación basada en el uso.
1

Obtener la clave de API

Cree o copie una clave de API desde el panel de OpenAI Platform.
2

Ejecutar la incorporación

O proporcione la clave directamente:
3

Verificar que el modelo esté disponible

Resumen de rutas

Con el runtime sin establecer o auto, solo una ruta nativa HTTPS oficial exacta y apta puede seleccionar implícitamente el arnés de app-server de Codex. Para la autenticación mediante clave de API en un modelo de agente, cree un perfil de autenticación mediante clave de API openai y ordénelo con auth.order.openai; OPENAI_API_KEY sigue siendo la alternativa directa para las superficies de la API de OpenAI que no sean de agentes. Ejecute openclaw doctor --fix para migrar entradas antiguas del orden de autenticación de Codex heredado.

Ejemplo de configuración

El id gpt-5.6 de la API directa sin calificar se resuelve al nivel Sol. Si esta organización de la API no ofrece GPT-5.6, establezca explícitamente el modelo principal en openai/gpt-5.5.Para probar el modelo Instant actual de ChatGPT desde la API de OpenAI, establezca el modelo en openai/chat-latest:
chat-latest es un alias dinámico. En cambio, la nueva configuración mediante clave de API de OpenAI utiliza openai/gpt-5.6, cuyo id de API directa sin calificar se resuelve a Sol. Los modelos principales explícitos existentes, incluido openai/gpt-5.5, permanecen sin cambios. El alias chat-latest solo acepta la verbosidad de texto medium; OpenClaw fuerza cualquier otra verbosidad solicitada a medium para este modelo.
OpenClaw no expone gpt-5.3-codex-spark en la ruta directa mediante clave de API de OpenAI. Solo está disponible mediante entradas del catálogo de suscripción de Codex cuando la cuenta con la que se ha iniciado sesión lo ofrece.

Autenticación del servidor de aplicaciones nativo de Codex

El entorno de servidor de aplicaciones nativo de Codex utiliza referencias de modelo openai/* cuando una ruta HTTPS oficial exacta y apta lo selecciona implícitamente, o cuando la configuración de proveedor/modelo agentRuntime.id: "codex" lo selecciona explícitamente. Su autenticación sigue estando basada en cuentas. OpenClaw selecciona la autenticación en este orden:
  1. Perfiles de autenticación de OpenAI ordenados para el agente, preferiblemente en auth.order.openai. Ejecute openclaw doctor --fix para migrar identificadores anteriores de perfiles de autenticación heredados de Codex y el orden de autenticación.
  2. La cuenta existente del servidor de aplicaciones, como un inicio de sesión local de ChatGPT en la CLI de Codex. Para el directorio principal aislado predeterminado del agente, OpenClaw enlaza esa cuenta nativa de la CLI con el servidor de aplicaciones mediante su RPC de inicio de sesión; no comparte la configuración, los plugins ni el almacén de hilos de la CLI.
  3. Solo para ejecuciones locales del servidor de aplicaciones mediante stdio y únicamente cuando el servidor de aplicaciones no informa de ninguna cuenta: CODEX_API_KEY y después OPENAI_API_KEY.
Un inicio de sesión local de suscripción de ChatGPT/Codex no se sustituye solo porque el proceso del Gateway también disponga de OPENAI_API_KEY para modelos directos de OpenAI o representaciones vectoriales. La alternativa mediante clave de API del entorno solo se aplica a la ruta local de stdio sin cuenta; nunca se envía mediante conexiones WebSocket del servidor de aplicaciones. Cuando se selecciona un perfil de Codex basado en suscripción, OpenClaw también mantiene CODEX_API_KEY y OPENAI_API_KEY fuera del proceso hijo del servidor de aplicaciones stdio y envía las credenciales seleccionadas mediante el RPC de inicio de sesión del servidor de aplicaciones. Cuando ese perfil de suscripción queda bloqueado por un límite de uso de Codex, OpenClaw marca el perfil como bloqueado hasta la hora de restablecimiento anunciada por Codex y permite que el orden de autenticación rote al siguiente perfil openai:*, sin cambiar el modelo seleccionado ni abandonar el entorno de Codex. Una vez transcurrida la hora de restablecimiento, el perfil de suscripción vuelve a ser apto.

Generación de imágenes

El plugin openai incluido registra la generación de imágenes mediante la herramienta image_generate. Admite la generación de imágenes tanto mediante clave de API de OpenAI como mediante OAuth de Codex con la misma referencia de modelo openai/gpt-image-2.
Consulte Generación de imágenes para conocer los parámetros compartidos de la herramienta, la selección de proveedores y el comportamiento de conmutación por error.
gpt-image-2 es el valor predeterminado para la generación de imágenes a partir de texto y la edición de imágenes de OpenAI. gpt-image-1.5, gpt-image-1 y gpt-image-1-mini siguen estando disponibles como sustituciones explícitas del modelo. Use openai/gpt-image-1.5 para obtener salidas PNG/WebP con fondo transparente; la API actual gpt-image-2 rechaza background: "transparent". Para una solicitud con fondo transparente, invoque image_generate con model: "openai/gpt-image-1.5", outputFormat: "png" o "webp", y background: "transparent"; la opción anterior de proveedor openai.background todavía se acepta. OpenClaw también protege las rutas públicas de OpenAI y OAuth de OpenAI Codex reescribiendo las solicitudes transparentes predeterminadas de openai/gpt-image-2 como gpt-image-1.5; Azure y los endpoints personalizados compatibles con OpenAI conservan sus nombres configurados de implementación/modelo. La misma configuración está disponible para ejecuciones de la CLI sin interfaz gráfica:
Use las mismas opciones --output-format y --background con openclaw infer image edit cuando parta de un archivo de entrada. --openai-background sigue estando disponible como alias específico de OpenAI. Use --quality low|medium|high|auto para controlar la calidad y el coste de las imágenes de OpenAI. Use --openai-moderation low|auto para pasar la indicación de moderación de OpenAI desde image generate o image edit. Para las instalaciones OAuth de ChatGPT/Codex, mantenga la misma referencia openai/gpt-image-2. Cuando se configura un perfil OAuth openai, OpenClaw resuelve ese token de acceso OAuth almacenado y envía las solicitudes de imágenes mediante el backend Codex Responses; no intenta primero OPENAI_API_KEY ni recurre silenciosamente a una clave de API. Configure models.providers.openai explícitamente con una clave de API, una URL base personalizada o un endpoint de Azure cuando quiera usar en su lugar la ruta directa de la API de OpenAI Images. Si ese endpoint de imágenes personalizado se encuentra en una dirección LAN/privada de confianza, establezca también browser.ssrfPolicy.dangerouslyAllowPrivateNetwork: true; OpenClaw mantiene bloqueados los endpoints de imágenes privados/internos compatibles con OpenAI a menos que esta habilitación explícita esté presente. Generar:
Generar un PNG transparente:
Editar:

Generación de vídeo

El plugin openai incluido registra la generación de vídeo mediante la herramienta video_generate. Las solicitudes de imagen a vídeo de OpenAI usan POST /v1/videos con una input_reference de imagen. Las ediciones de un solo vídeo usan POST /v1/videos/edits con el vídeo cargado en el campo video.
Consulte Generación de vídeo para conocer los parámetros compartidos de la herramienta, la selección del proveedor y el comportamiento de conmutación por error.El proveedor de OpenAI declara supportsSize, pero no supportsAspectRatio ni supportsResolution. La capa de normalización compartida de OpenClaw convierte una aspectRatio solicitada en el size de OpenAI que más se aproxime antes de que la solicitud llegue al proveedor, por lo que las solicitudes de relación de aspecto suelen seguir funcionando. resolution no tiene alternativa de tamaño y se descarta, lo que se comunica al llamador como Ignored unsupported overrides for openai/<model>: resolution=<value>.

Contribución al prompt de GPT-5

OpenClaw añade una contribución compartida al prompt de GPT-5 para los modelos de la familia GPT-5 en el proveedor openai (incluidas las referencias heredadas de Codex anteriores a la reparación que se normalizan a openai/*). Otros proveedores que también ofrecen identificadores de modelos de la familia GPT-5, como OpenRouter o las rutas de opencode, no reciben esta capa; se condiciona al identificador de proveedor openai, no solo al identificador de modelo. Los modelos GPT-4.x anteriores nunca la reciben. El entorno nativo del servidor de aplicaciones de Codex no recibe el contrato de comportamiento de personalidad y disciplina de herramientas ni la capa de estilo de interacción cordial mediante instrucciones para desarrolladores; Codex nativo conserva el comportamiento base, de modelo y de documentación del proyecto propio de Codex, y OpenClaw desactiva la personalidad integrada de Codex para los hilos nativos, de modo que los archivos de personalidad del espacio de trabajo del agente sigan siendo la autoridad. OpenClaw solo aporta contexto de ejecución a los hilos nativos de Codex: entrega por canales, herramientas dinámicas de OpenClaw, delegación ACP, contexto del espacio de trabajo y Skills de OpenClaw. El texto de orientación de Heartbeat de esta misma contribución es la única excepción: los turnos de Heartbeat de Codex nativo sí lo reciben, insertado como instrucciones de colaboración específicas en lugar de mediante el enlace compartido de contribución al prompt. La contribución de GPT-5 añade un contrato de comportamiento etiquetado para la persistencia de la personalidad, la seguridad de ejecución, la disciplina de herramientas, la forma de la salida, las comprobaciones de finalización y la verificación en los prompts coincidentes ensamblados por OpenClaw. El comportamiento de respuesta y de mensajes silenciosos específico de cada canal permanece en el prompt del sistema compartido de OpenClaw y en la política de entrega saliente. La capa de estilo de interacción cordial es independiente y configurable.
Los valores no distinguen entre mayúsculas y minúsculas durante la ejecución, por lo que tanto "Off" como "off" desactivan la capa de estilo cordial.
El valor heredado plugins.entries.openai.config.personality aún se lee como alternativa de compatibilidad cuando el ajuste compartido agents.defaults.promptOverlays.gpt5.personality no está establecido.

Voz y habla

El plugin openai incluido registra la síntesis de voz para la superficie tts.Modelos disponibles: gpt-4o-mini-tts, tts-1, tts-1-hd. Voces disponibles: alloy, ash, ballad, cedar, coral, echo, fable, juniper, marin, onyx, nova, sage, shimmer, verse.extraBody se combina con el JSON de la solicitud /audio/speech después de los campos generados por OpenClaw, por lo que debe usarse para endpoints compatibles con OpenAI que requieran claves adicionales como lang. Las claves de prototipo se ignoran.
Establezca OPENAI_TTS_BASE_URL para anular la URL base de TTS sin afectar al endpoint de la API de chat. Tanto TTS de OpenAI como la voz en tiempo real se configuran mediante una clave de API de OpenAI Platform; las instalaciones que solo usan OAuth aún pueden utilizar modelos de chat respaldados por Codex, pero no la conversación bidireccional en vivo de OpenAI.
El plugin openai incluido registra la conversión por lotes de voz a texto mediante la superficie de transcripción para comprensión de medios de OpenClaw.
  • Modelo predeterminado: gpt-4o-transcribe
  • Endpoint: REST de OpenAI /v1/audio/transcriptions
  • Ruta de entrada: carga de archivo de audio multiparte
  • Se usa siempre que la transcripción de audio entrante lee tools.media.audio, incluidos los segmentos de canales de voz de Discord y los archivos adjuntos de audio de los canales
Para forzar el uso de OpenAI en la transcripción de audio entrante:
Las indicaciones de idioma y prompt se reenvían a OpenAI cuando las proporciona la configuración compartida de medios de audio o la solicitud de transcripción de cada llamada.
El plugin openai incluido registra la transcripción en tiempo real para el plugin Voice Call.
Usa una conexión WebSocket a wss://api.openai.com/v1/realtime con audio G.711 u-law (g711_ulaw / audio/pcmu). Para un perfil de clave de API openai, el Gateway genera un secreto efímero de cliente para la transcripción en tiempo real antes de abrir el WebSocket. Este proveedor de streaming se utiliza para la ruta de transcripción en tiempo real de Voice Call; actualmente, Discord graba segmentos cortos y utiliza en su lugar la ruta de transcripción por lotes tools.media.audio.
El plugin openai incluido registra la voz en tiempo real para el plugin Voice Call.Voces Realtime integradas disponibles para gpt-realtime-2.1: alloy, ash, ballad, coral, echo, sage, shimmer, verse, marin, cedar. OpenAI recomienda marin y cedar para obtener la mejor calidad de Realtime. Este es un conjunto distinto del de las voces de texto a voz anteriores; una voz exclusiva de TTS, como fable, nova o onyx, no es válida para sesiones de Realtime. Establezca explícitamente el modelo en gpt-realtime-2.1-mini si prefiere la variante Realtime 2.1 más pequeña y de menor costo.
GPT-Live (próximamente). Los modelos dúplex completos gpt-live-1 y gpt-live-1-mini de OpenAI sustituyeron el modo de voz de ChatGPT en julio de 2026; la API para desarrolladores se está implementando para organizaciones con acceso anticipado. OpenClaw reconoce la familia de modelos, pero aún no la ejecuta: las sesiones de GPT-Live solo funcionan con WebRTC, gestionan sus propios turnos (sin VAD) y delegan el trabajo del agente mediante un protocolo de eventos de transferencia que los transportes de Realtime de OpenClaw todavía no implementan. Configurar un modelo gpt-live-* produce un fallo seguro con indicaciones tanto para el puente WebSocket como para las sesiones de Talk en el navegador, en lugar de conectar silenciosamente el audio sin acceso al agente. El acceso a la API también está restringido por organización de OpenAI durante el acceso anticipado. Mantenga gpt-realtime-2.1 (el valor predeterminado) hasta que se incorpore la compatibilidad con GPT-Live.
Los puentes de Realtime de OpenAI del backend utilizan la estructura de sesión WebSocket de Realtime con disponibilidad general, que no acepta session.temperature. Las implementaciones de Azure OpenAI siguen estando disponibles mediante azureEndpoint y azureDeployment, y conservan la estructura de sesión compatible con la implementación (incluido temperature). Admite llamadas bidireccionales a herramientas y audio G.711 u-law.
La voz de Realtime se selecciona al crear la sesión. OpenAI permite cambiar posteriormente la mayoría de los campos de la sesión, pero la voz no se puede cambiar después de que el modelo haya emitido audio en esa sesión. Actualmente, OpenClaw expone los identificadores de las voces Realtime integradas como cadenas.
Talk de la interfaz de control utiliza sesiones de Realtime de OpenAI en el navegador con un secreto de cliente efímero emitido por el Gateway y un intercambio SDP directo de WebRTC desde el navegador con la API Realtime de OpenAI. El Gateway emite ese secreto de cliente con la credencial openai seleccionada. Las claves configuradas, los perfiles de clave de API y OPENAI_API_KEY tienen prioridad; un perfil OAuth openai o un inicio de sesión externo de Codex se utiliza como alternativa. El relé del Gateway y los puentes WebSocket de Realtime del backend de Voice Call utilizan el mismo orden de credenciales para los endpoints nativos de OpenAI. La verificación en vivo para mantenedores está disponible mediante OPENAI_API_KEY=... GEMINI_API_KEY=... node --import tsx scripts/dev/realtime-talk-live-smoke.ts; los segmentos de OpenAI verifican tanto el puente WebSocket del backend como el intercambio SDP de WebRTC del navegador sin registrar secretos. Pase --openai-only para ejecutar esos dos segmentos sin credenciales de Google.

Endpoints de Azure OpenAI

El proveedor openai incluido puede dirigirse a un recurso de Azure OpenAI para la generación de imágenes reemplazando la URL base. En la ruta de generación de imágenes, OpenClaw detecta los nombres de host de Azure en models.providers.openai.baseUrl y cambia automáticamente a la estructura de solicitud de Azure.
La voz de Realtime utiliza una ruta de configuración independiente (plugins.entries.voice-call.config.realtime.providers.openai.azureEndpoint) y no se ve afectada por models.providers.openai.baseUrl. Consulte el acordeón Voz de Realtime en Voz y habla para conocer sus ajustes de Azure.
Use Azure OpenAI cuando:
  • Ya disponga de una suscripción, cuota o acuerdo empresarial de Azure OpenAI
  • Necesite la residencia regional de datos o los controles de cumplimiento que proporciona Azure
  • Quiera mantener el tráfico dentro de una suscripción existente de Azure

Configuración

Para generar imágenes en Azure mediante el proveedor openai incluido, dirija models.providers.openai.baseUrl a su recurso de Azure y establezca apiKey en la clave de Azure OpenAI (no una clave de OpenAI Platform):
OpenClaw reconoce estos sufijos de host de Azure para la ruta de generación de imágenes de Azure:
  • *.openai.azure.com
  • *.services.ai.azure.com
  • *.cognitiveservices.azure.com
Para las solicitudes de generación de imágenes en un host de Azure reconocido, OpenClaw:
  • Envía el encabezado api-key en lugar de Authorization: Bearer
  • Utiliza rutas limitadas a la implementación (/openai/deployments/{deployment}/...)
  • Añade ?api-version=... a cada solicitud
  • Utiliza un tiempo de espera predeterminado de 600s para las llamadas de generación de imágenes de Azure. Los valores de timeoutMs por llamada siguen reemplazando este valor predeterminado.
Las demás URL base (OpenAI público y proxies compatibles con OpenAI) conservan la estructura estándar de solicitud de imágenes de OpenAI.
El enrutamiento de Azure para la ruta de generación de imágenes del proveedor openai requiere OpenClaw 2026.4.22 o posterior. Las versiones anteriores tratan cualquier openai.baseUrl personalizado como el endpoint público de OpenAI y fallan con las implementaciones de imágenes de Azure.

Versión de la API

Establezca AZURE_OPENAI_API_VERSION para fijar una versión preliminar o con disponibilidad general específica de Azure para la ruta de generación de imágenes de Azure:
El valor predeterminado es 2024-12-01-preview cuando la variable no está establecida.

Los nombres de modelo son nombres de implementación

Azure OpenAI vincula los modelos a implementaciones. Para las solicitudes de generación de imágenes de Azure enrutadas mediante el proveedor openai incluido, el campo model de OpenClaw debe ser el nombre de la implementación de Azure configurado en el portal de Azure, no el identificador público del modelo de OpenAI. Si crea una implementación llamada gpt-image-2-prod que sirve gpt-image-2:
La misma regla del nombre de implementación se aplica a cualquier llamada de generación de imágenes enrutada mediante el proveedor openai incluido.

Disponibilidad regional

Actualmente, la generación de imágenes de Azure solo está disponible en un subconjunto de regiones (por ejemplo, eastus2, swedencentral, polandcentral, westus3, uaenorth). Consulte la lista actual de regiones de Microsoft antes de crear una implementación y confirme que el modelo específico esté disponible en su región.

Diferencias entre parámetros

Azure OpenAI y OpenAI público no siempre aceptan los mismos parámetros de imagen. Azure puede rechazar opciones permitidas por OpenAI público (por ejemplo, determinados valores de background en gpt-image-2) o exponerlas únicamente en versiones específicas del modelo. Estas diferencias proceden de Azure y del modelo subyacente, no de OpenClaw. Si una solicitud de Azure falla con un error de validación, consulte en el portal de Azure el conjunto de parámetros compatible con su implementación y versión de API específicas.
Azure OpenAI utiliza transporte nativo y comportamiento de compatibilidad, pero no recibe los encabezados ocultos de atribución de OpenClaw; consulte el acordeón Rutas nativas frente a rutas compatibles con OpenAI en Configuración avanzada.Para el tráfico de chat o Responses en Azure (además de la generación de imágenes), utilice el flujo de incorporación o una configuración específica del proveedor de Azure; openai.baseUrl por sí solo no adopta la estructura de API/autenticación de Azure. Existe un proveedor azure-openai-responses/* independiente; consulte el acordeón de Compaction del lado del servidor más adelante.

Configuración avanzada

Los siguientes ejemplos de params por modelo determinan la solicitud del proveedor integrado de OpenClaw. Configurarlos constituye un comportamiento de solicitud definido, por lo que una ruta auto que cumpla los requisitos permanece en OpenClaw en lugar de seleccionar Codex implícitamente. El entorno del servidor de aplicaciones nativo de Codex administra su propio transporte y sus propios ajustes de solicitud; un agentRuntime.id: "codex" explícito produce un fallo seguro cuando la ruta efectiva no está declarada como compatible con Codex.
OpenClaw utiliza WebSocket primero con SSE como alternativa ("auto") para openai/*.En el modo "auto", OpenClaw:
  • Reintenta una vez tras un fallo inicial de WebSocket antes de recurrir a SSE
  • Después de un fallo, marca WebSocket como degradado durante 60 segundos y utiliza SSE durante el periodo de espera
  • Adjunta encabezados estables de identidad de sesión y turno para los reintentos y las reconexiones
  • Normaliza los contadores de uso (input_tokens / prompt_tokens) entre las variantes de transporte
Documentación relacionada de OpenAI:
OpenClaw ofrece un control compartido del modo rápido para openai/*:
  • Chat/interfaz: /fast status|auto|on|off
  • Configuración: agents.defaults.models["<provider>/<model>"].params.fastMode
Cuando está habilitado, OpenClaw asigna el modo rápido al procesamiento prioritario de OpenAI (service_tier = "priority"). Los valores existentes de service_tier se conservan, y el modo rápido no modifica reasoning ni text.verbosity. fastMode: "auto" inicia rápidamente las nuevas llamadas al modelo hasta el límite automático y, después, inicia las llamadas posteriores de reintento, alternativa, resultado de herramienta o continuación sin el modo rápido. El límite predeterminado es de 60 segundos; establezca params.fastAutoOnSeconds en el modelo activo para cambiarlo.
Las sustituciones de la sesión tienen prioridad sobre la configuración. Al borrar la sustitución de la sesión en la interfaz de Sessions, la sesión vuelve al valor predeterminado configurado.
La API de OpenAI ofrece procesamiento prioritario mediante service_tier. Se configura por modelo en OpenClaw:
Valores admitidos: auto, default, flex, priority.
serviceTier solo se reenvía a los endpoints nativos de OpenAI (api.openai.com) y a los endpoints nativos de Codex (chatgpt.com/backend-api). Si se enruta cualquiera de los proveedores mediante un proxy, OpenClaw no modifica service_tier.
Para los modelos directos de OpenAI Responses (openai/* en api.openai.com), el contenedor de flujos de OpenClaw del Plugin de OpenAI habilita automáticamente la Compaction del lado del servidor:
  • Fuerza store: true (a menos que la compatibilidad del modelo establezca supportsStore: false)
  • Inyecta context_management: [{ type: "compaction", compact_threshold: ... }]
  • Valor predeterminado de compact_threshold: el 70 % de contextWindow (o 80000 cuando no esté disponible)
Esto se aplica a la ruta integrada del entorno de ejecución de OpenClaw y a los hooks del proveedor de OpenAI utilizados por las ejecuciones integradas. El entorno nativo del servidor de aplicaciones de Codex gestiona su propio contexto mediante Codex y esta configuración no le afecta.
Resulta útil para endpoints compatibles, como Azure OpenAI Responses:
responsesServerCompaction solo controla la inyección de context_management. Los modelos directos de OpenAI Responses siguen forzando store: true, a menos que la compatibilidad establezca supportsStore: false.
Para los modelos de la familia GPT-5 del proveedor openai que se ejecutan mediante el entorno de ejecución integrado de OpenClaw, OpenClaw ya utiliza de forma predeterminada un contrato de ejecución más estricto denominado strict-agentic. Se activa automáticamente siempre que el proveedor resuelto sea openai y el id del modelo coincida con la familia GPT-5, salvo que la configuración deshabilite explícitamente este comportamiento:
Establecer "strict-agentic" explícitamente no produce ningún efecto en una ruta compatible (ya es el valor predeterminado) y permanece inactivo para las combinaciones de proveedor y modelo no compatibles.Con strict-agentic activo, OpenClaw:
  • Habilita automáticamente update_plan para trabajos sustanciales
  • Reintenta los turnos estructuralmente vacíos o que solo contienen razonamiento con una continuación que proporciona una respuesta visible
  • Utiliza eventos de planificación explícitos del entorno cuando el entorno seleccionado los proporciona
OpenClaw no clasifica el texto del asistente para decidir si un turno es un plan, una actualización del progreso o una respuesta final.
Este contrato reside íntegramente en el ejecutor de agentes integrado de OpenClaw. No se aplica al entorno nativo del servidor de aplicaciones de Codex, que gestiona su propio comportamiento de turnos y planes; para las ejecuciones nativas de Codex, la selección del entorno es más importante que la configuración del contrato de ejecución.
OpenClaw trata los endpoints directos de OpenAI, Codex y Azure OpenAI de forma distinta a los proxies genéricos /v1 compatibles con OpenAI:Rutas nativas (openai/*, Azure OpenAI):
  • Conservan reasoning: { effort: "none" } solo para los modelos compatibles con el nivel de esfuerzo none de OpenAI
  • Omiten el razonamiento deshabilitado para los modelos o proxies que rechazan reasoning.effort: "none"
  • Utilizan de forma predeterminada el modo estricto para los esquemas de herramientas
  • Adjuntan encabezados de atribución ocultos únicamente en hosts nativos verificados (Azure OpenAI no recibe estos encabezados, aunque sea una ruta nativa)
  • Mantienen la adaptación de solicitudes exclusiva de OpenAI (service_tier, store, compatibilidad de razonamiento, indicaciones de caché de prompts)
Rutas de proxy/compatibles:
  • Utilizan un comportamiento de compatibilidad menos estricto
  • Eliminan store de Completions de las cargas útiles openai-completions no nativas
  • Aceptan JSON avanzado de paso directo params.extra_body/params.extraBody para proxies de Completions compatibles con OpenAI
  • Aceptan params.chat_template_kwargs para proxies de Completions compatibles con OpenAI, como vLLM
  • No fuerzan esquemas estrictos de herramientas ni encabezados exclusivos de rutas nativas

Temas relacionados

Selección de modelos

Selección de proveedores, referencias de modelos y comportamiento de conmutación por error.

Generación de imágenes

Parámetros compartidos de la herramienta de imágenes y selección de proveedores.

Generación de vídeo

Parámetros compartidos de la herramienta de vídeo y selección de proveedores.

OAuth y autenticación

Detalles de autenticación y reglas de reutilización de credenciales.