Skip to main content
NVIDIA ofrece modelos abiertos de forma gratuita mediante una API compatible con OpenAI en https://integrate.api.nvidia.com/v1, autenticada con una clave de API de build.nvidia.com. OpenClaw establece de forma predeterminada Nemotron 3 Ultra para el proveedor NVIDIA, el modelo de razonamiento de NVIDIA con 550B de parámetros totales / 55B activos para trabajo agéntico con contextos largos.

Primeros pasos

1

Obtener la clave de API

Cree una clave de API en build.nvidia.com.
2

Exportar la clave y ejecutar la incorporación

3

Establecer un modelo de NVIDIA

Para una configuración no interactiva, pase la clave directamente:
--nvidia-api-key guarda la clave en el historial del shell y en la salida de ps. Siempre que sea posible, es preferible usar la variable de entorno NVIDIA_API_KEY.

Ejemplo de configuración

Catálogo destacado

Cuando se configura una clave de API de NVIDIA, las rutas de configuración y selección de modelos obtienen el catálogo público de modelos destacados de NVIDIA desde https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json y almacenan el resultado en caché durante 24 horas (las primeras 32 entradas, importadas como filas gratuitas con entrada de texto). Por lo tanto, los nuevos modelos destacados de build.nvidia.com aparecen en las superficies de configuración y selección de modelos sin esperar a una versión de OpenClaw. Cuando la fuente en directo está disponible, el primer modelo devuelto es la opción preseleccionada durante la configuración de NVIDIA. La obtención utiliza una política fija de host HTTPS para assets.ngc.nvidia.com. Si no se configura ninguna clave de API de NVIDIA, o si la fuente no está disponible o tiene un formato incorrecto, OpenClaw recurre al catálogo incluido y al valor predeterminado incluido que se indican a continuación.

Nemotron 3 Ultra

Nemotron 3 Ultra es el modelo de NVIDIA predeterminado en OpenClaw. La página de NVIDIA Build para nvidia/nemotron-3-ultra-550b-a55b lo muestra como un endpoint gratuito disponible con una especificación de contexto de 1M tokens. La fila incluida de Ultra envía chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true } de forma predeterminada para que la salida normal del chat permanezca en la respuesta visible en lugar de exponer el texto de razonamiento. Use Ultra como opción predeterminada de NVIDIA con la mayor capacidad. Mantenga Super seleccionado cuando quiera la opción Nemotron 3 más pequeña, o elija uno de los modelos de terceros alojados en el catálogo de NVIDIA cuando su contexto, latencia o comportamiento resulte más adecuado.

Catálogo alternativo incluido

Las filas seleccionables incluidas son una instantánea del catálogo de modelos destacados de NVIDIA. Las filas de compatibilidad obsoletas siguen siendo accesibles mediante la referencia exacta, pero no aparecen en los selectores de modelos. El catálogo de compatibilidad completo también conserva estas referencias publicadas para las configuraciones existentes: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 y nvidia/minimaxai/minimax-m2.7. Siguen estando disponibles mediante la referencia exacta, pero nunca aparecen durante la incorporación ni en los selectores de modelos.

Configuración avanzada

El proveedor se activa automáticamente cuando se establece la variable de entorno NVIDIA_API_KEY o cuando se ha guardado una clave durante la incorporación. No se requiere ninguna configuración explícita del proveedor aparte de la clave.
OpenClaw prefiere el catálogo público de modelos destacados de NVIDIA cuando la autenticación de NVIDIA está configurada y lo almacena en caché durante 24 horas. La alternativa seleccionable incluida es una instantánea estática del catálogo de modelos destacados de NVIDIA; las filas de compatibilidad obsoletas accesibles mediante referencia exacta se ocultan de los selectores de modelos. Los costes tienen como valor predeterminado 0 en el código fuente, ya que NVIDIA ofrece actualmente acceso gratuito mediante API a los modelos indicados.
OpenClaw se comunica con NVIDIA mediante el adaptador openai-completions a través de la ruta estándar de completado de chat /v1. Cualquier herramienta compatible con OpenAI debería funcionar de inmediato con la URL base de NVIDIA.
La solicitud de ejemplo de Ultra de NVIDIA utiliza chat_template_kwargs.enable_thinking y reasoning_budget para la salida de razonamiento. La fila incluida de Ultra de OpenClaw desactiva de forma predeterminada el razonamiento de la plantilla para el uso normal del chat. Si necesita habilitar la salida de razonamiento de NVIDIA o forzar otros campos de solicitud específicos de NVIDIA, establezca parámetros por modelo y limite las sustituciones específicas del proveedor al modelo de NVIDIA:
params.chat_template_kwargs se combina con cualquier chat_template_kwargs que ya esté en la solicitud en lugar de reemplazar el objeto completo. params.extra_body es la sustitución final del cuerpo de la solicitud compatible con OpenAI y sobrescribe las claves de la carga útil que coincidan, por lo que debe usarse únicamente para los campos que NVIDIA documente para el endpoint seleccionado.
Algunos modelos personalizados alojados por NVIDIA pueden tardar más que los ~120s predeterminados del supervisor de inactividad del modelo antes de emitir el primer fragmento de respuesta. Para las entradas personalizadas del proveedor NVIDIA, aumente el tiempo de espera del proveedor en lugar del tiempo de espera de todo el entorno de ejecución del agente; timeoutSeconds abarca las solicitudes HTTP del proveedor y aumenta el límite del supervisor de inactividad o transmisión para ese proveedor:
Actualmente, los modelos de NVIDIA se pueden usar gratuitamente. Consulte build.nvidia.com para conocer la disponibilidad más reciente y los detalles de los límites de solicitudes.

Contenido relacionado

Selección de modelos

Selección de proveedores, referencias de modelos y comportamiento de conmutación por error.

Referencia de configuración

Referencia completa de configuración para agentes, modelos y proveedores.