Skip to main content
NVIDIA, OpenAI-संगत API के माध्यम से खुले मॉडल निःशुल्क उपलब्ध कराता है: https://integrate.api.nvidia.com/v1, जिसका प्रमाणीकरण build.nvidia.com से प्राप्त API कुंजी से होता है। OpenClaw NVIDIA प्रदाता के लिए डिफ़ॉल्ट रूप से Nemotron 3 Ultra का उपयोग करता है, जो लंबे-कॉन्टेक्स्ट वाले एजेंटिक कार्य के लिए NVIDIA का कुल 550B / सक्रिय 55B रीज़निंग मॉडल है।

आरंभ करना

1

अपनी API कुंजी प्राप्त करें

build.nvidia.com पर एक API कुंजी बनाएँ।
2

कुंजी एक्सपोर्ट करें और ऑनबोर्डिंग चलाएँ

3

एक NVIDIA मॉडल सेट करें

गैर-इंटरैक्टिव सेटअप के लिए कुंजी सीधे दें:
--nvidia-api-key कुंजी को शेल इतिहास और ps आउटपुट में दर्ज कर देता है। जहाँ संभव हो, NVIDIA_API_KEY पर्यावरण चर को प्राथमिकता दें।

कॉन्फ़िगरेशन उदाहरण

विशेष रूप से प्रदर्शित कैटलॉग

जब NVIDIA API कुंजी कॉन्फ़िगर होती है, तो सेटअप और मॉडल-चयन पथ https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json से NVIDIA का सार्वजनिक विशेष रूप से प्रदर्शित मॉडल कैटलॉग प्राप्त करते हैं और परिणाम को 24 घंटे के लिए कैश करते हैं (पहली 32 प्रविष्टियाँ, मुक्त टेक्स्ट-इनपुट पंक्तियों के रूप में आयातित)। इसलिए build.nvidia.com के नए विशेष रूप से प्रदर्शित मॉडल किसी OpenClaw रिलीज़ की प्रतीक्षा किए बिना सेटअप और मॉडल-चयन सतहों में दिखाई देते हैं। लाइव फ़ीड उपलब्ध होने पर, NVIDIA सेटअप के दौरान वापस आया पहला मॉडल पहले से चयनित विकल्प होता है। प्राप्ति प्रक्रिया assets.ngc.nvidia.com के लिए एक निश्चित HTTPS होस्ट नीति का उपयोग करती है। यदि कोई NVIDIA API कुंजी कॉन्फ़िगर नहीं है, या फ़ीड अनुपलब्ध अथवा विकृत है, तो OpenClaw नीचे दिए गए बंडल किए गए कैटलॉग और बंडल किए गए डिफ़ॉल्ट पर वापस चला जाता है।

Nemotron 3 Ultra

Nemotron 3 Ultra, OpenClaw में डिफ़ॉल्ट NVIDIA मॉडल है। nvidia/nemotron-3-ultra-550b-a55b के लिए NVIDIA का बिल्ड पृष्ठ इसे 1M-टोकन कॉन्टेक्स्ट विनिर्देश वाले उपलब्ध निःशुल्क एंडपॉइंट के रूप में सूचीबद्ध करता है। बंडल की गई Ultra पंक्ति डिफ़ॉल्ट रूप से chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true } भेजती है, ताकि सामान्य चैट आउटपुट रीज़निंग टेक्स्ट को उजागर करने के बजाय दृश्यमान उत्तर में रहे। उच्चतम क्षमता वाले NVIDIA डिफ़ॉल्ट के लिए Ultra का उपयोग करें। यदि आपको Nemotron 3 का छोटा विकल्प चाहिए, तो Super को चयनित रखें; या NVIDIA के कैटलॉग में होस्ट किए गए तृतीय-पक्ष मॉडल में से वह मॉडल चुनें जिसका कॉन्टेक्स्ट, विलंबता या व्यवहार अधिक उपयुक्त हो।

बंडल किया गया फ़ॉलबैक कैटलॉग

चयन योग्य बंडल पंक्तियाँ NVIDIA के विशेष रूप से प्रदर्शित मॉडल कैटलॉग का स्नैपशॉट हैं। अप्रचलित संगतता पंक्तियाँ सटीक संदर्भ द्वारा समाधान योग्य रहती हैं, लेकिन मॉडल चयनकर्ताओं में दिखाई नहीं देतीं। पूर्ण संगतता कैटलॉग मौजूदा कॉन्फ़िगरेशन के लिए भेजे जा चुके इन संदर्भों को भी बनाए रखता है: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5, और nvidia/minimaxai/minimax-m2.7। ये सटीक संदर्भ द्वारा उपलब्ध रहते हैं, लेकिन ऑनबोर्डिंग या मॉडल चयनकर्ताओं में कभी दिखाई नहीं देते।

उन्नत कॉन्फ़िगरेशन

जब NVIDIA_API_KEY पर्यावरण चर सेट होता है या ऑनबोर्डिंग के दौरान कोई कुंजी संग्रहीत की गई हो, तब प्रदाता स्वतः सक्षम हो जाता है। कुंजी के अतिरिक्त किसी स्पष्ट प्रदाता कॉन्फ़िगरेशन की आवश्यकता नहीं है।
NVIDIA प्रमाणीकरण कॉन्फ़िगर होने पर OpenClaw, NVIDIA के सार्वजनिक विशेष रूप से प्रदर्शित मॉडल कैटलॉग को प्राथमिकता देता है और उसे 24 घंटे के लिए कैश करता है। बंडल किया गया चयन योग्य फ़ॉलबैक, NVIDIA के विशेष रूप से प्रदर्शित मॉडल कैटलॉग का स्थिर स्नैपशॉट है; अप्रचलित सटीक-संदर्भ संगतता पंक्तियाँ मॉडल चयनकर्ताओं से छिपी रहती हैं। स्रोत में लागत डिफ़ॉल्ट रूप से 0 है, क्योंकि NVIDIA वर्तमान में सूचीबद्ध मॉडलों के लिए निःशुल्क API पहुँच प्रदान करता है।
OpenClaw, मानक /v1 चैट कंप्लीशन्स रूट पर openai-completions अडैप्टर के साथ NVIDIA से संचार करता है। कोई भी OpenAI-संगत टूलिंग NVIDIA बेस URL के साथ बिना अतिरिक्त सेटअप के काम करनी चाहिए।
NVIDIA का Ultra नमूना अनुरोध रीज़निंग आउटपुट के लिए chat_template_kwargs.enable_thinking और reasoning_budget का उपयोग करता है। OpenClaw की बंडल की गई Ultra पंक्ति सामान्य चैट उपयोग के लिए डिफ़ॉल्ट रूप से टेम्पलेट थिंकिंग अक्षम करती है। यदि आपको NVIDIA रीज़निंग आउटपुट चुनना हो या NVIDIA-विशिष्ट अन्य अनुरोध फ़ील्ड अनिवार्य करने हों, तो प्रति-मॉडल पैरामीटर सेट करें और प्रदाता-विशिष्ट ओवरराइड को NVIDIA मॉडल तक सीमित रखें:
params.chat_template_kwargs, पूरे ऑब्जेक्ट को बदलने के बजाय अनुरोध पर पहले से मौजूद किसी भी chat_template_kwargs में मर्ज हो जाता है। params.extra_body अंतिम OpenAI-संगत अनुरोध-बॉडी ओवरराइड है और टकराने वाली पेलोड कुंजियों को अधिलेखित करता है, इसलिए इसका उपयोग केवल उन फ़ील्ड के लिए करें जिन्हें NVIDIA चयनित एंडपॉइंट हेतु प्रलेखित करता है।
NVIDIA पर होस्ट किए गए कुछ कस्टम मॉडल, पहली प्रतिक्रिया खंड भेजने से पहले डिफ़ॉल्ट ~120s मॉडल निष्क्रियता वॉचडॉग से अधिक समय ले सकते हैं। कस्टम NVIDIA प्रदाता प्रविष्टियों के लिए, पूरे एजेंट रनटाइम टाइमआउट के बजाय प्रदाता टाइमआउट बढ़ाएँ; timeoutSeconds प्रदाता HTTP अनुरोधों को कवर करता है और उस प्रदाता के लिए निष्क्रियता/स्ट्रीम वॉचडॉग सीमा बढ़ाता है:
NVIDIA मॉडलों का उपयोग वर्तमान में निःशुल्क है। नवीनतम उपलब्धता और दर-सीमा के विवरण के लिए build.nvidia.com देखें।

संबंधित

मॉडल चयन

प्रदाताओं, मॉडल संदर्भों और फ़ेलओवर व्यवहार का चयन।

कॉन्फ़िगरेशन संदर्भ

एजेंटों, मॉडलों और प्रदाताओं के लिए पूर्ण कॉन्फ़िगरेशन संदर्भ।