https://integrate.api.nvidia.com/v1, autenticada con una clave de API de
build.nvidia.com. OpenClaw
establece de forma predeterminada Nemotron 3 Ultra para el proveedor NVIDIA, el modelo de razonamiento de NVIDIA con 550B de parámetros totales / 55B
activos para trabajo agéntico con contextos largos.
Primeros pasos
1
Obtener la clave de API
Cree una clave de API en build.nvidia.com.
2
Exportar la clave y ejecutar la incorporación
3
Establecer un modelo de NVIDIA
Ejemplo de configuración
Catálogo destacado
Cuando se configura una clave de API de NVIDIA, las rutas de configuración y selección de modelos obtienen el catálogo público de modelos destacados de NVIDIA desdehttps://assets.ngc.nvidia.com/products/api-catalog/featured-models.json y
almacenan el resultado en caché durante 24 horas (las primeras 32 entradas, importadas como
filas gratuitas con entrada de texto). Por lo tanto, los nuevos modelos destacados de build.nvidia.com aparecen en las superficies de configuración y
selección de modelos sin esperar a una versión de OpenClaw. Cuando la
fuente en directo está disponible, el primer modelo devuelto es la opción preseleccionada
durante la configuración de NVIDIA.
La obtención utiliza una política fija de host HTTPS para assets.ngc.nvidia.com. Si no
se configura ninguna clave de API de NVIDIA, o si la fuente no está disponible o tiene un formato incorrecto,
OpenClaw recurre al catálogo incluido y al valor predeterminado incluido que se indican a continuación.
Nemotron 3 Ultra
Nemotron 3 Ultra es el modelo de NVIDIA predeterminado en OpenClaw. La página de NVIDIA Build paranvidia/nemotron-3-ultra-550b-a55b
lo muestra como un endpoint gratuito disponible con una especificación de contexto de 1M tokens.
La fila incluida de Ultra envía
chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }
de forma predeterminada para que la salida normal del chat permanezca en la respuesta visible en lugar de
exponer el texto de razonamiento.
Use Ultra como opción predeterminada de NVIDIA con la mayor capacidad. Mantenga Super seleccionado cuando
quiera la opción Nemotron 3 más pequeña, o elija uno de los modelos de terceros
alojados en el catálogo de NVIDIA cuando su contexto, latencia o comportamiento resulte más adecuado.
Catálogo alternativo incluido
Las filas seleccionables incluidas son una instantánea del catálogo de modelos destacados de NVIDIA. Las filas de compatibilidad obsoletas siguen siendo accesibles mediante la referencia exacta, pero no aparecen en los selectores de modelos.
El catálogo de compatibilidad completo también conserva estas referencias publicadas para las configuraciones
existentes:
nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1,
nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 y
nvidia/minimaxai/minimax-m2.7. Siguen estando disponibles mediante la referencia exacta, pero
nunca aparecen durante la incorporación ni en los selectores de modelos.
Configuración avanzada
Comportamiento de activación automática
Comportamiento de activación automática
El proveedor se activa automáticamente cuando se establece la variable de entorno
NVIDIA_API_KEY
o cuando se ha guardado una clave durante la incorporación. No se requiere ninguna configuración explícita del proveedor
aparte de la clave.Catálogo y precios
Catálogo y precios
OpenClaw prefiere el catálogo público de modelos destacados de NVIDIA cuando la autenticación de NVIDIA está
configurada y lo almacena en caché durante 24 horas. La alternativa seleccionable incluida es una
instantánea estática del catálogo de modelos destacados de NVIDIA; las filas de compatibilidad obsoletas
accesibles mediante referencia exacta se ocultan de los selectores de modelos. Los costes tienen como valor predeterminado
0 en
el código fuente, ya que NVIDIA ofrece actualmente acceso gratuito mediante API a los modelos indicados.Endpoint compatible con OpenAI
Endpoint compatible con OpenAI
OpenClaw se comunica con NVIDIA mediante el adaptador
openai-completions a través de la
ruta estándar de completado de chat /v1. Cualquier herramienta compatible con OpenAI debería
funcionar de inmediato con la URL base de NVIDIA.Parámetros de razonamiento de Nemotron 3 Ultra
Parámetros de razonamiento de Nemotron 3 Ultra
La solicitud de ejemplo de Ultra de NVIDIA utiliza
chat_template_kwargs.enable_thinking
y reasoning_budget para la salida de razonamiento. La fila incluida de Ultra de OpenClaw
desactiva de forma predeterminada el razonamiento de la plantilla para el uso normal del chat. Si necesita
habilitar la salida de razonamiento de NVIDIA o forzar otros campos de solicitud
específicos de NVIDIA, establezca parámetros por modelo y limite las sustituciones específicas del proveedor
al modelo de NVIDIA:params.chat_template_kwargs se combina con cualquier chat_template_kwargs
que ya esté en la solicitud en lugar de reemplazar el objeto completo.
params.extra_body es la sustitución final del cuerpo de la solicitud compatible con OpenAI
y sobrescribe las claves de la carga útil que coincidan, por lo que debe usarse únicamente para los campos que NVIDIA
documente para el endpoint seleccionado.Respuestas lentas de proveedores personalizados
Respuestas lentas de proveedores personalizados
Algunos modelos personalizados alojados por NVIDIA pueden tardar más que los ~120s predeterminados
del supervisor de inactividad del modelo antes de emitir el primer fragmento de respuesta. Para las entradas
personalizadas del proveedor NVIDIA, aumente el tiempo de espera del proveedor en lugar del tiempo de espera de todo
el entorno de ejecución del agente;
timeoutSeconds abarca las solicitudes HTTP del proveedor y
aumenta el límite del supervisor de inactividad o transmisión para ese proveedor:Contenido relacionado
Selección de modelos
Selección de proveedores, referencias de modelos y comportamiento de conmutación por error.
Referencia de configuración
Referencia completa de configuración para agentes, modelos y proveedores.