openai, tanto para la autenticación directa con clave de API como para
la autenticación mediante suscripción de ChatGPT/Codex. openai/* es la ruta de modelo canónica.
Para los turnos del agente integrado cuya política de runtime no esté definida o sea auto, los datos de ruta
de OpenAI determinan si OpenClaw puede seleccionar implícitamente el runtime incluido del servidor de aplicaciones de Codex.
El prefijo openai/* por sí solo no selecciona ningún runtime.
- Modelos de agente -
openai/*mediante el runtime seleccionado por la configuración explícitaagentRuntimeo por la política de ruta implícita de OpenAI. Inicie sesión con la autenticación de Codex para usar una suscripción de ChatGPT/Codex, o configure un perfil de autenticación con clave de API si desea facturación basada en claves. - API de OpenAI ajenas al agente - acceso directo a OpenAI Platform, facturado por uso,
mediante
OPENAI_API_KEYo un perfil de autenticación con clave de APIopenai. - Configuración heredada - las referencias
codex/*yopenai-codex/*se reparan comoopenai/*másagentRuntime.id: "codex"con ámbito de modelo medianteopenclaw doctor --fix.
Seguimiento del uso y los costes
OpenClaw mantiene separados la cuota de suscripción y la facturación de la API de Platform:- OAuth de ChatGPT/Codex muestra el plan de suscripción, los períodos de cuota y el saldo de créditos.
OPENAI_ADMIN_KEYmuestra 30 días de costes de la organización y uso de completions informados por el proveedor en Uso de Control UI, incluidos el gasto diario, los totales de solicitudes/tokens, los modelos principales y las categorías de costes.OPENAI_PROJECT_IDlimita opcionalmente el historial de la Admin API a un proyecto.- OpenClaw nunca envía
OPENAI_API_KEYni un perfil de inferenciaopenaia las API de la organización; esas credenciales pueden pertenecer a endpoints personalizados, de Azure o locales del agente.
Elección rápida
Mapa de nombres
Runtime implícito del agente
Cuando la políticaagentRuntime del proveedor/modelo no está definida o es auto, la política
de ruta propiedad del proveedor de OpenAI elige el runtime implícito a partir del
endpoint y el adaptador efectivos:
Una configuración
agentRuntime.id explícita y no predeterminada del proveedor/modelo sigue siendo vinculante.
Por ejemplo, agentRuntime.id: "openclaw" mantiene en OpenClaw una ruta que, de otro modo, sería
apta para Codex, mientras que agentRuntime.id: "codex" exige Codex y falla
de forma cerrada cuando la ruta efectiva no está declarada como compatible con Codex.
La selección del runtime no cambia el tipo de credencial ni la facturación: la autenticación
con clave de API de Platform y la autenticación mediante suscripción de ChatGPT/Codex siguen siendo distintas.
openclaw doctor --fix migra las referencias de modelo heredadas codex/* y openai-codex/*,
los ids de perfil de autenticación de Codex heredados y las entradas de orden de autenticación de Codex heredadas
a la ruta canónica openai. Las referencias de modelo migradas reciben
agentRuntime.id: "codex" con ámbito de modelo; use auth.order.openai para las nuevas configuraciones de orden de autenticación.
La configuración nueva de OpenAI solo aplica un modelo principal GPT-5.6 cuando no hay ningún modelo principal
configurado. Añadir o actualizar la autenticación de OpenAI conserva cualquier selección explícita
existente, incluida
openai/gpt-5.5, salvo que se use explícitamente
models auth login --set-default o models set. Use un perfil de autenticación con clave de API
solo cuando desee autenticación mediante clave de API para un modelo de agente.Vista previa limitada de GPT-5.6
OpenClaw reconoce los ids de modelo exactosopenai/gpt-5.6-sol,
openai/gpt-5.6-terra y openai/gpt-5.6-luna. Los tres ofrecen los niveles de razonamiento
xhigh y max en el catálogo actual. OpenAI describe Sol como
el nivel insignia, Terra como el nivel equilibrado y Luna como el nivel rápido
y de menor coste. Consulte el
anuncio de lanzamiento de GPT-5.6
y la guía de acceso.
Con autenticación directa mediante clave de API de OpenAI, el id básico openai/gpt-5.6 es un alias de
Sol y el valor predeterminado de la configuración nueva. El catálogo nativo de Codex no aplica
ese alias de API directa en el cliente; según el acceso del espacio de trabajo, puede mostrar
los ids exactos de Sol, Terra y Luna. Por tanto, la configuración nueva de OAuth de ChatGPT/Codex
usa openai/gpt-5.6-sol. Compruebe la cuenta actual con:
Las rutas HTTPS oficiales exactas que cumplan los requisitos pueden seleccionar el Plugin incluido del servidor de aplicaciones
de Codex cuando la política del runtime no está definida o es
auto; las rutas de Completions definidas,
los endpoints personalizados y las anulaciones del transporte de solicitudes permanecen en OpenClaw. Los endpoints
HTTP oficiales sin cifrar se rechazan. La configuración explícita del runtime del proveedor/modelo sigue siendo
vinculante. Ejecute openclaw doctor --fix para reparar referencias de modelo de Codex heredadas y obsoletas,
referencias codex-cli/* o asignaciones antiguas de sesiones de runtime que no se establecieron mediante
una configuración explícita del runtime.Cobertura de funciones de OpenClaw
La voz en tiempo real de OpenAI pasa por la API Realtime pública de OpenAI
Platform y requiere una clave de API de Platform. En cambio, los tokens OAuth
de Codex autentican el backend de ChatGPT Codex; no son intercambiables con las
claves de API de Platform para los endpoints públicos de Realtime.Si la autenticación mediante clave de API informa que falta facturación, recargue
los créditos de Platform en
platform.openai.com/account/billing
para la organización que respalda sus credenciales de tiempo real cuando utilice
la autenticación mediante clave de API. La voz en tiempo real acepta el perfil de
autenticación mediante clave de API
openai creado por
openclaw onboard --auth-choice openai-api-key, una clave de API de Platform establecida mediante
talk.realtime.providers.openai.apiKey para Control UI Talk, o
plugins.entries.voice-call.config.realtime.providers.openai.apiKey para Voice
Call, o la variable de entorno OPENAI_API_KEY.En Control UI Video Talk, OpenAI WebRTC recibe el contexto de la cámara bajo
demanda: cuando el modelo llama a describe_view, el navegador envía un único
JPEG de tamaño limitado por el canal de datos en tiempo real. OpenClaw no adjunta
una pista continua de la cámara a la sesión de OpenAI.Embeddings de memoria
OpenClaw puede utilizar OpenAI, o un endpoint de embeddings compatible con OpenAI, para la indexación dememory_search y los embeddings de consultas:
queryInputType y documentInputType en
memory.search. OpenClaw los reenvía como campos de solicitud
input_type específicos del proveedor: los embeddings de consultas
utilizan queryInputType; los fragmentos de memoria indexados y la indexación
por lotes utilizan documentInputType. Consulte la
referencia de configuración de memoria
para ver el ejemplo completo.
Primeros pasos
- Clave de API (OpenAI Platform)
- Suscripción de Codex
Ideal para: acceso directo a la API y facturación basada en el uso.O proporcione la clave directamente:El id
1
Obtener la clave de API
Cree o copie una clave de API desde el panel de OpenAI Platform.
2
Ejecutar la incorporación
3
Verificar que el modelo esté disponible
Resumen de rutas
Con el runtime sin establecer o
auto, solo una ruta nativa
HTTPS oficial exacta y apta puede seleccionar implícitamente el arnés de
app-server de Codex. Para la autenticación mediante clave de API en un modelo
de agente, cree un perfil de autenticación mediante clave de API
openai y ordénelo con auth.order.openai;
OPENAI_API_KEY sigue siendo la alternativa directa para las superficies
de la API de OpenAI que no sean de agentes. Ejecute openclaw doctor --fix para
migrar entradas antiguas del orden de autenticación de Codex heredado.Ejemplo de configuración
gpt-5.6 de la API directa sin calificar se resuelve al nivel
Sol. Si esta organización de la API no ofrece GPT-5.6, establezca
explícitamente el modelo principal en openai/gpt-5.5.Para probar el modelo Instant actual de ChatGPT desde la API de OpenAI,
establezca el modelo en openai/chat-latest:chat-latest es un alias dinámico. En cambio, la nueva configuración
mediante clave de API de OpenAI utiliza openai/gpt-5.6, cuyo id de API
directa sin calificar se resuelve a Sol. Los modelos principales explícitos
existentes, incluido openai/gpt-5.5, permanecen sin cambios. El alias
chat-latest solo acepta la verbosidad de texto medium;
OpenClaw fuerza cualquier otra verbosidad solicitada a medium
para este modelo.Autenticación del servidor de aplicaciones nativo de Codex
El entorno de servidor de aplicaciones nativo de Codex utiliza referencias de modeloopenai/* cuando una ruta
HTTPS oficial exacta y apta lo selecciona implícitamente, o cuando la configuración de proveedor/modelo
agentRuntime.id: "codex" lo selecciona explícitamente. Su autenticación sigue estando
basada en cuentas. OpenClaw selecciona la autenticación en este orden:
- Perfiles de autenticación de OpenAI ordenados para el agente, preferiblemente en
auth.order.openai. Ejecuteopenclaw doctor --fixpara migrar identificadores anteriores de perfiles de autenticación heredados de Codex y el orden de autenticación. - La cuenta existente del servidor de aplicaciones, como un inicio de sesión local de ChatGPT en la CLI de Codex. Para el directorio principal aislado predeterminado del agente, OpenClaw enlaza esa cuenta nativa de la CLI con el servidor de aplicaciones mediante su RPC de inicio de sesión; no comparte la configuración, los plugins ni el almacén de hilos de la CLI.
- Solo para ejecuciones locales del servidor de aplicaciones mediante stdio y únicamente cuando el servidor de aplicaciones
no informa de ninguna cuenta:
CODEX_API_KEYy despuésOPENAI_API_KEY.
OPENAI_API_KEY para modelos directos de OpenAI o
representaciones vectoriales. La alternativa mediante clave de API del entorno solo se aplica a la ruta local
de stdio sin cuenta; nunca se envía mediante conexiones WebSocket del servidor de aplicaciones. Cuando se
selecciona un perfil de Codex basado en suscripción, OpenClaw también mantiene
CODEX_API_KEY y OPENAI_API_KEY fuera del proceso hijo del servidor de aplicaciones stdio
y envía las credenciales seleccionadas mediante el RPC de inicio de sesión del servidor de aplicaciones.
Cuando ese perfil de suscripción queda bloqueado por un límite de uso de Codex, OpenClaw
marca el perfil como bloqueado hasta la hora de restablecimiento anunciada por Codex y permite que el orden de
autenticación rote al siguiente perfil openai:*, sin cambiar el modelo seleccionado
ni abandonar el entorno de Codex. Una vez transcurrida la hora de restablecimiento, el
perfil de suscripción vuelve a ser apto.
Generación de imágenes
El pluginopenai incluido registra la generación de imágenes mediante la
herramienta image_generate. Admite la generación de imágenes tanto mediante clave de API de OpenAI como mediante
OAuth de Codex con la misma referencia de modelo openai/gpt-image-2.
Consulte Generación de imágenes para conocer los parámetros compartidos de la herramienta,
la selección de proveedores y el comportamiento de conmutación por error.
gpt-image-2 es el valor predeterminado para la generación de imágenes a partir de texto y la edición de imágenes
de OpenAI. gpt-image-1.5, gpt-image-1 y gpt-image-1-mini siguen estando disponibles
como sustituciones explícitas del modelo. Use openai/gpt-image-1.5 para obtener
salidas PNG/WebP con fondo transparente; la API actual gpt-image-2 rechaza
background: "transparent".
Para una solicitud con fondo transparente, invoque image_generate con
model: "openai/gpt-image-1.5", outputFormat: "png" o "webp", y
background: "transparent"; la opción anterior de proveedor openai.background
todavía se acepta. OpenClaw también protege las rutas públicas de OpenAI y OAuth de OpenAI Codex
reescribiendo las solicitudes transparentes predeterminadas de openai/gpt-image-2 como
gpt-image-1.5; Azure y los endpoints personalizados compatibles con OpenAI conservan sus
nombres configurados de implementación/modelo.
La misma configuración está disponible para ejecuciones de la CLI sin interfaz gráfica:
--output-format y --background con
openclaw infer image edit cuando parta de un archivo de entrada.
--openai-background sigue estando disponible como alias específico de OpenAI. Use
--quality low|medium|high|auto para controlar la calidad y el coste de las imágenes de OpenAI.
Use --openai-moderation low|auto para pasar la indicación de moderación de OpenAI desde
image generate o image edit.
Para las instalaciones OAuth de ChatGPT/Codex, mantenga la misma referencia openai/gpt-image-2. Cuando
se configura un perfil OAuth openai, OpenClaw resuelve ese token de acceso OAuth
almacenado y envía las solicitudes de imágenes mediante el backend Codex Responses; no
intenta primero OPENAI_API_KEY ni recurre silenciosamente a una clave de API.
Configure models.providers.openai explícitamente con una clave de API, una URL base
personalizada o un endpoint de Azure cuando quiera usar en su lugar la ruta directa
de la API de OpenAI Images. Si ese endpoint de imágenes personalizado se encuentra en una
dirección LAN/privada de confianza, establezca también browser.ssrfPolicy.dangerouslyAllowPrivateNetwork: true; OpenClaw
mantiene bloqueados los endpoints de imágenes privados/internos compatibles con OpenAI
a menos que esta habilitación explícita esté presente.
Generar:
Generación de vídeo
El pluginopenai incluido registra la generación de vídeo mediante la
herramienta video_generate.
Las solicitudes de imagen a vídeo de OpenAI usan
POST /v1/videos con una
input_reference de imagen. Las ediciones de un solo vídeo usan POST /v1/videos/edits con el
vídeo cargado en el campo video.
Consulte Generación de vídeo para conocer los parámetros compartidos de la herramienta,
la selección del proveedor y el comportamiento de conmutación por error.El proveedor de OpenAI declara
supportsSize, pero no supportsAspectRatio ni
supportsResolution. La capa de normalización compartida de OpenClaw convierte una
aspectRatio solicitada en el size de OpenAI que más se aproxime antes de que la
solicitud llegue al proveedor, por lo que las solicitudes de relación de aspecto suelen seguir funcionando.
resolution no tiene alternativa de tamaño y se descarta, lo que se comunica al llamador como
Ignored unsupported overrides for openai/<model>: resolution=<value>.Contribución al prompt de GPT-5
OpenClaw añade una contribución compartida al prompt de GPT-5 para los modelos de la familia GPT-5 en el proveedoropenai (incluidas las referencias heredadas de Codex anteriores a la reparación que se normalizan
a openai/*). Otros proveedores que también ofrecen identificadores de modelos de la familia GPT-5, como
OpenRouter o las rutas de opencode, no reciben esta capa; se condiciona al
identificador de proveedor openai, no solo al identificador de modelo. Los modelos GPT-4.x anteriores nunca
la reciben.
El entorno nativo del servidor de aplicaciones de Codex no recibe el contrato de comportamiento
de personalidad y disciplina de herramientas ni la capa de estilo de interacción cordial mediante
instrucciones para desarrolladores; Codex nativo conserva el comportamiento base, de modelo y
de documentación del proyecto propio de Codex, y OpenClaw desactiva la personalidad integrada de Codex para
los hilos nativos, de modo que los archivos de personalidad del espacio de trabajo del agente sigan siendo la autoridad.
OpenClaw solo aporta contexto de ejecución a los hilos nativos de Codex: entrega
por canales, herramientas dinámicas de OpenClaw, delegación ACP, contexto del espacio de trabajo y
Skills de OpenClaw. El texto de orientación de Heartbeat de esta misma contribución es la
única excepción: los turnos de Heartbeat de Codex nativo sí lo reciben, insertado como
instrucciones de colaboración específicas en lugar de mediante el enlace compartido
de contribución al prompt.
La contribución de GPT-5 añade un contrato de comportamiento etiquetado para la persistencia
de la personalidad, la seguridad de ejecución, la disciplina de herramientas, la forma de la salida, las comprobaciones
de finalización y la verificación en los prompts coincidentes ensamblados por OpenClaw. El comportamiento
de respuesta y de mensajes silenciosos específico de cada canal permanece en el prompt del sistema compartido
de OpenClaw y en la política de entrega saliente. La capa de estilo de interacción cordial es
independiente y configurable.
- Configuración
- CLI
El valor heredado
plugins.entries.openai.config.personality aún se lee como
alternativa de compatibilidad cuando el ajuste compartido
agents.defaults.promptOverlays.gpt5.personality no está establecido.Voz y habla
Síntesis de voz (TTS)
Síntesis de voz (TTS)
El plugin
openai incluido registra la síntesis de voz para la
superficie tts.Modelos disponibles:
gpt-4o-mini-tts, tts-1, tts-1-hd. Voces disponibles:
alloy, ash, ballad, cedar, coral, echo, fable, juniper,
marin, onyx, nova, sage, shimmer, verse.extraBody se combina con el JSON de la solicitud /audio/speech después de los
campos generados por OpenClaw, por lo que debe usarse para endpoints compatibles con OpenAI que requieran
claves adicionales como lang. Las claves de prototipo se ignoran.Establezca
OPENAI_TTS_BASE_URL para anular la URL base de TTS sin afectar
al endpoint de la API de chat. Tanto TTS de OpenAI como la voz en tiempo real se configuran
mediante una clave de API de OpenAI Platform; las instalaciones que solo usan OAuth aún pueden utilizar
modelos de chat respaldados por Codex, pero no la conversación bidireccional en vivo de OpenAI.Voz a texto
Voz a texto
El plugin Las indicaciones de idioma y prompt se reenvían a OpenAI cuando las proporciona la
configuración compartida de medios de audio o la solicitud de transcripción de cada llamada.
openai incluido registra la conversión por lotes de voz a texto mediante
la superficie de transcripción para comprensión de medios de OpenClaw.- Modelo predeterminado:
gpt-4o-transcribe - Endpoint: REST de OpenAI
/v1/audio/transcriptions - Ruta de entrada: carga de archivo de audio multiparte
- Se usa siempre que la transcripción de audio entrante lee
tools.media.audio, incluidos los segmentos de canales de voz de Discord y los archivos adjuntos de audio de los canales
Transcripción en tiempo real
Transcripción en tiempo real
El plugin
openai incluido registra la transcripción en tiempo real para el
plugin Voice Call.Usa una conexión WebSocket a
wss://api.openai.com/v1/realtime con
audio G.711 u-law (g711_ulaw / audio/pcmu). Para un perfil de clave de API openai,
el Gateway genera un secreto efímero de cliente para la transcripción en tiempo real
antes de abrir el WebSocket. Este proveedor de streaming se utiliza para la ruta de transcripción
en tiempo real de Voice Call; actualmente, Discord graba segmentos cortos
y utiliza en su lugar la ruta de transcripción por lotes tools.media.audio.Voz en tiempo real
Voz en tiempo real
El plugin
openai incluido registra la voz en tiempo real para el plugin Voice Call.Voces Realtime integradas disponibles para
gpt-realtime-2.1: alloy, ash,
ballad, coral, echo, sage, shimmer, verse, marin, cedar.
OpenAI recomienda marin y cedar para obtener la mejor calidad de Realtime. Este
es un conjunto distinto del de las voces de texto a voz anteriores; una voz exclusiva de TTS,
como fable, nova o onyx, no es válida para sesiones de Realtime.
Establezca explícitamente el modelo en gpt-realtime-2.1-mini si prefiere la
variante Realtime 2.1 más pequeña y de menor costo.GPT-Live (próximamente). Los modelos dúplex completos
gpt-live-1 y
gpt-live-1-mini de OpenAI sustituyeron el modo de voz de ChatGPT en julio de 2026; la
API para desarrolladores se está implementando para organizaciones con acceso anticipado. OpenClaw
reconoce la familia de modelos, pero aún no la ejecuta: las sesiones de GPT-Live
solo funcionan con WebRTC, gestionan sus propios turnos (sin VAD) y delegan el trabajo del agente
mediante un protocolo de eventos de transferencia que los transportes de Realtime de OpenClaw
todavía no implementan. Configurar un modelo gpt-live-* produce un fallo seguro con
indicaciones tanto para el puente WebSocket como para las sesiones de Talk en el navegador, en lugar de
conectar silenciosamente el audio sin acceso al agente. El acceso a la API también está restringido
por organización de OpenAI durante el acceso anticipado. Mantenga gpt-realtime-2.1 (el
valor predeterminado) hasta que se incorpore la compatibilidad con GPT-Live.Los puentes de Realtime de OpenAI del backend utilizan la estructura de sesión WebSocket de Realtime
con disponibilidad general, que no acepta
session.temperature. Las implementaciones de Azure OpenAI
siguen estando disponibles mediante azureEndpoint y azureDeployment, y
conservan la estructura de sesión compatible con la implementación (incluido temperature).
Admite llamadas bidireccionales a herramientas y audio G.711 u-law.La voz de Realtime se selecciona al crear la sesión. OpenAI permite cambiar posteriormente la mayoría
de los campos de la sesión, pero la voz no se puede cambiar después de que el
modelo haya emitido audio en esa sesión. Actualmente, OpenClaw expone los
identificadores de las voces Realtime integradas como cadenas.
Talk de la interfaz de control utiliza sesiones de Realtime de OpenAI en el navegador con un secreto de cliente
efímero emitido por el Gateway y un intercambio SDP directo de WebRTC desde el navegador
con la API Realtime de OpenAI. El Gateway emite ese secreto de cliente con
la credencial
openai seleccionada. Las claves configuradas, los perfiles de clave de API y
OPENAI_API_KEY tienen prioridad; un perfil OAuth openai o un inicio de sesión
externo de Codex se utiliza como alternativa. El relé del Gateway y los puentes WebSocket de Realtime
del backend de Voice Call utilizan el mismo orden de credenciales para los endpoints nativos de OpenAI.
La verificación en vivo para mantenedores está disponible mediante
OPENAI_API_KEY=... GEMINI_API_KEY=... node --import tsx scripts/dev/realtime-talk-live-smoke.ts;
los segmentos de OpenAI verifican tanto el puente WebSocket del backend como el intercambio SDP
de WebRTC del navegador sin registrar secretos.
Pase --openai-only para ejecutar esos dos segmentos sin credenciales de Google.Endpoints de Azure OpenAI
El proveedoropenai incluido puede dirigirse a un recurso de Azure OpenAI para la generación
de imágenes reemplazando la URL base. En la ruta de generación de imágenes, OpenClaw
detecta los nombres de host de Azure en models.providers.openai.baseUrl y cambia automáticamente a
la estructura de solicitud de Azure.
La voz de Realtime utiliza una ruta de configuración independiente
(
plugins.entries.voice-call.config.realtime.providers.openai.azureEndpoint)
y no se ve afectada por models.providers.openai.baseUrl. Consulte el acordeón Voz de
Realtime en Voz y habla para conocer sus ajustes de Azure.- Ya disponga de una suscripción, cuota o acuerdo empresarial de Azure OpenAI
- Necesite la residencia regional de datos o los controles de cumplimiento que proporciona Azure
- Quiera mantener el tráfico dentro de una suscripción existente de Azure
Configuración
Para generar imágenes en Azure mediante el proveedoropenai incluido, dirija
models.providers.openai.baseUrl a su recurso de Azure y establezca apiKey en
la clave de Azure OpenAI (no una clave de OpenAI Platform):
*.openai.azure.com*.services.ai.azure.com*.cognitiveservices.azure.com
- Envía el encabezado
api-keyen lugar deAuthorization: Bearer - Utiliza rutas limitadas a la implementación (
/openai/deployments/{deployment}/...) - Añade
?api-version=...a cada solicitud - Utiliza un tiempo de espera predeterminado de 600s para las llamadas de generación de imágenes de Azure.
Los valores de
timeoutMspor llamada siguen reemplazando este valor predeterminado.
El enrutamiento de Azure para la ruta de generación de imágenes del proveedor
openai requiere
OpenClaw 2026.4.22 o posterior. Las versiones anteriores tratan cualquier
openai.baseUrl personalizado como el endpoint público de OpenAI y fallan con las implementaciones
de imágenes de Azure.Versión de la API
EstablezcaAZURE_OPENAI_API_VERSION para fijar una versión preliminar o con disponibilidad general específica
de Azure para la ruta de generación de imágenes de Azure:
2024-12-01-preview cuando la variable no está establecida.
Los nombres de modelo son nombres de implementación
Azure OpenAI vincula los modelos a implementaciones. Para las solicitudes de generación de imágenes de Azure enrutadas mediante el proveedoropenai incluido, el campo model de OpenClaw
debe ser el nombre de la implementación de Azure configurado en el portal de Azure, no
el identificador público del modelo de OpenAI.
Si crea una implementación llamada gpt-image-2-prod que sirve gpt-image-2:
openai incluido.
Disponibilidad regional
Actualmente, la generación de imágenes de Azure solo está disponible en un subconjunto de regiones (por ejemplo,eastus2, swedencentral, polandcentral, westus3,
uaenorth). Consulte la lista actual de regiones de Microsoft antes de crear una
implementación y confirme que el modelo específico esté disponible en su región.
Diferencias entre parámetros
Azure OpenAI y OpenAI público no siempre aceptan los mismos parámetros de imagen. Azure puede rechazar opciones permitidas por OpenAI público (por ejemplo, determinados valores debackground en gpt-image-2) o exponerlas únicamente en versiones específicas
del modelo. Estas diferencias proceden de Azure y del modelo subyacente, no de
OpenClaw. Si una solicitud de Azure falla con un error de validación, consulte en el
portal de Azure el conjunto de parámetros compatible con su implementación y versión de API
específicas.
Azure OpenAI utiliza transporte nativo y comportamiento de compatibilidad, pero no recibe
los encabezados ocultos de atribución de OpenClaw; consulte el acordeón Rutas nativas frente a
rutas compatibles con OpenAI en Configuración avanzada.Para el tráfico de chat o Responses en Azure (además de la generación de imágenes), utilice el
flujo de incorporación o una configuración específica del proveedor de Azure;
openai.baseUrl por sí solo
no adopta la estructura de API/autenticación de Azure. Existe un proveedor
azure-openai-responses/* independiente; consulte el acordeón de Compaction del lado del servidor
más adelante.Configuración avanzada
Los siguientes ejemplos deparams por modelo determinan la solicitud del proveedor
integrado de OpenClaw. Configurarlos constituye un comportamiento de solicitud definido, por lo que una ruta
auto que cumpla los requisitos permanece en OpenClaw en lugar de seleccionar Codex implícitamente. El
entorno del servidor de aplicaciones nativo de Codex administra su propio transporte y sus propios ajustes de solicitud; un
agentRuntime.id: "codex" explícito produce un fallo seguro cuando la ruta efectiva no está declarada como
compatible con Codex.
Transporte (WebSocket frente a SSE)
Transporte (WebSocket frente a SSE)
OpenClaw utiliza WebSocket primero con SSE como alternativa (Documentación relacionada de OpenAI:
"auto") para openai/*.En el modo "auto", OpenClaw:- Reintenta una vez tras un fallo inicial de WebSocket antes de recurrir a SSE
- Después de un fallo, marca WebSocket como degradado durante 60 segundos y utiliza SSE durante el periodo de espera
- Adjunta encabezados estables de identidad de sesión y turno para los reintentos y las reconexiones
- Normaliza los contadores de uso (
input_tokens/prompt_tokens) entre las variantes de transporte
Modo rápido
Modo rápido
OpenClaw ofrece un control compartido del modo rápido para
openai/*:- Chat/interfaz:
/fast status|auto|on|off - Configuración:
agents.defaults.models["<provider>/<model>"].params.fastMode
service_tier = "priority"). Los valores existentes de service_tier se
conservan, y el modo rápido no modifica reasoning ni
text.verbosity. fastMode: "auto" inicia rápidamente las nuevas llamadas al modelo hasta el
límite automático y, después, inicia las llamadas posteriores de reintento, alternativa, resultado de herramienta o
continuación sin el modo rápido. El límite predeterminado es de 60 segundos;
establezca params.fastAutoOnSeconds en el modelo activo para cambiarlo.Las sustituciones de la sesión tienen prioridad sobre la configuración. Al borrar la sustitución de la sesión en la
interfaz de Sessions, la sesión vuelve al valor predeterminado configurado.
Procesamiento prioritario (service_tier)
Procesamiento prioritario (service_tier)
La API de OpenAI ofrece procesamiento prioritario mediante Valores admitidos:
service_tier. Se configura por
modelo en OpenClaw:auto, default, flex, priority.Compaction del lado del servidor (API Responses)
Compaction del lado del servidor (API Responses)
Para los modelos directos de OpenAI Responses (
openai/* en api.openai.com), el
contenedor de flujos de OpenClaw del Plugin de OpenAI habilita automáticamente la
Compaction del lado del servidor:- Fuerza
store: true(a menos que la compatibilidad del modelo establezcasupportsStore: false) - Inyecta
context_management: [{ type: "compaction", compact_threshold: ... }] - Valor predeterminado de
compact_threshold: el 70 % decontextWindow(o80000cuando no esté disponible)
- Habilitar explícitamente
- Umbral personalizado
- Deshabilitar
Resulta útil para endpoints compatibles, como Azure OpenAI Responses:
responsesServerCompaction solo controla la inyección de context_management.
Los modelos directos de OpenAI Responses siguen forzando store: true, a menos que la compatibilidad
establezca supportsStore: false.Modo GPT agéntico estricto
Modo GPT agéntico estricto
Para los modelos de la familia GPT-5 del proveedor Establecer
openai que se ejecutan mediante el
entorno de ejecución integrado de OpenClaw, OpenClaw ya utiliza de forma predeterminada un contrato de
ejecución más estricto denominado strict-agentic. Se activa automáticamente siempre que el proveedor
resuelto sea openai y el id del modelo coincida con la familia GPT-5, salvo que la configuración
deshabilite explícitamente este comportamiento:"strict-agentic" explícitamente no produce ningún efecto en una ruta compatible (ya
es el valor predeterminado) y permanece inactivo para las combinaciones de proveedor y modelo no compatibles.Con strict-agentic activo, OpenClaw:- Habilita automáticamente
update_planpara trabajos sustanciales - Reintenta los turnos estructuralmente vacíos o que solo contienen razonamiento con una continuación que proporciona una respuesta visible
- Utiliza eventos de planificación explícitos del entorno cuando el entorno seleccionado los proporciona
Este contrato reside íntegramente en el ejecutor de agentes integrado de OpenClaw. No
se aplica al entorno nativo del servidor de aplicaciones de Codex, que gestiona su propio
comportamiento de turnos y planes; para las ejecuciones nativas de Codex, la selección del
entorno es más importante que la configuración del contrato de ejecución.
Rutas nativas frente a rutas compatibles con OpenAI
Rutas nativas frente a rutas compatibles con OpenAI
OpenClaw trata los endpoints directos de OpenAI, Codex y Azure OpenAI
de forma distinta a los proxies genéricos
/v1 compatibles con OpenAI:Rutas nativas (openai/*, Azure OpenAI):- Conservan
reasoning: { effort: "none" }solo para los modelos compatibles con el nivel de esfuerzononede OpenAI - Omiten el razonamiento deshabilitado para los modelos o proxies que rechazan
reasoning.effort: "none" - Utilizan de forma predeterminada el modo estricto para los esquemas de herramientas
- Adjuntan encabezados de atribución ocultos únicamente en hosts nativos verificados (Azure OpenAI no recibe estos encabezados, aunque sea una ruta nativa)
- Mantienen la adaptación de solicitudes exclusiva de OpenAI (
service_tier,store, compatibilidad de razonamiento, indicaciones de caché de prompts)
- Utilizan un comportamiento de compatibilidad menos estricto
- Eliminan
storede Completions de las cargas útilesopenai-completionsno nativas - Aceptan JSON avanzado de paso directo
params.extra_body/params.extraBodypara proxies de Completions compatibles con OpenAI - Aceptan
params.chat_template_kwargspara proxies de Completions compatibles con OpenAI, como vLLM - No fuerzan esquemas estrictos de herramientas ni encabezados exclusivos de rutas nativas
Temas relacionados
Selección de modelos
Selección de proveedores, referencias de modelos y comportamiento de conmutación por error.
Generación de imágenes
Parámetros compartidos de la herramienta de imágenes y selección de proveedores.
Generación de vídeo
Parámetros compartidos de la herramienta de vídeo y selección de proveedores.
OAuth y autenticación
Detalles de autenticación y reglas de reutilización de credenciales.