https://integrate.api.nvidia.com/v1، مع المصادقة باستخدام مفتاح API من
build.nvidia.com. يضبط OpenClaw
موفّر NVIDIA افتراضيًا على Nemotron 3 Ultra، وهو نموذج الاستدلال من NVIDIA الذي يضم
550 مليار مُعامل إجمالًا و55 مليار مُعامل نشط، والمخصص للعمل الوكيلي ذي السياق الطويل.
بدء الاستخدام
1
الحصول على مفتاح API
أنشئ مفتاح API على build.nvidia.com.
2
تصدير المفتاح وتشغيل الإعداد الأولي
3
تعيين نموذج NVIDIA
مثال على الإعداد
الكتالوج المميّز
عند إعداد مفتاح API لـ NVIDIA، تجلب مسارات الإعداد واختيار النموذج كتالوج النماذج المميّزة العام من NVIDIA منhttps://assets.ngc.nvidia.com/products/api-catalog/featured-models.json
وتخزّن النتيجة مؤقتًا لمدة 24 ساعة (أول 32 إدخالًا، تُستورد كصفوف لإدخال النص
المجاني). وبذلك تظهر النماذج المميّزة الجديدة من build.nvidia.com في واجهات الإعداد
واختيار النموذج من دون انتظار إصدار جديد من OpenClaw. عندما تكون الخلاصة المباشرة
متاحة، يكون أول نموذج مُعاد هو الخيار المحدد مسبقًا أثناء إعداد NVIDIA.
يستخدم الجلب سياسة مضيف HTTPS ثابتة لـ assets.ngc.nvidia.com. إذا لم يكن
مفتاح API لـ NVIDIA مُعدًا، أو إذا كانت الخلاصة غير متاحة أو غير صالحة،
يرجع OpenClaw إلى الكتالوج المضمّن والقيمة الافتراضية المضمّنة أدناه.
Nemotron 3 Ultra
Nemotron 3 Ultra هو نموذج NVIDIA الافتراضي في OpenClaw. تسرد صفحة البناء لدى NVIDIA للنموذجnvidia/nemotron-3-ultra-550b-a55b
النموذج كنقطة نهاية مجانية متاحة بمواصفات سياق يبلغ مليون رمز مميز.
يرسل صف Ultra المضمّن
chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }
افتراضيًا، بحيث تبقى مخرجات المحادثة العادية في الإجابة المرئية بدلًا من
إظهار نص الاستدلال.
استخدم Ultra بوصفه خيار NVIDIA الافتراضي الأعلى قدرة. أبقِ Super محددًا عندما
تريد خيار Nemotron 3 الأصغر، أو اختر أحد نماذج الجهات الخارجية
المستضافة في كتالوج NVIDIA عندما يكون سياقها أو زمن استجابتها أو سلوكها أنسب.
كتالوج الرجوع المضمّن
تمثل الصفوف المضمّنة القابلة للاختيار لقطة من كتالوج النماذج المميّزة لدى NVIDIA. تظل صفوف التوافق المهملة قابلة للحل باستخدام المرجع الدقيق، لكنها لا تظهر في أدوات اختيار النماذج.
يحتفظ كتالوج التوافق الكامل أيضًا بهذه المراجع المنشورة للإعدادات
الحالية:
nvidia/moonshotai/kimi-k2.5 وnvidia/z-ai/glm-5.1
وnvidia/minimaxai/minimax-m2.5 وnvidia/z-ai/glm5 و
nvidia/minimaxai/minimax-m2.7. تظل متاحة باستخدام المرجع الدقيق، لكنها
لا تظهر مطلقًا في الإعداد الأولي أو أدوات اختيار النماذج.
الإعداد المتقدم
سلوك التفعيل التلقائي
سلوك التفعيل التلقائي
يُفعّل الموفّر تلقائيًا عند تعيين متغير البيئة
NVIDIA_API_KEY
أو عند تخزين مفتاح أثناء الإعداد الأولي. لا يلزم إعداد صريح للموفّر
بخلاف المفتاح.الكتالوج والتسعير
الكتالوج والتسعير
يفضّل OpenClaw كتالوج النماذج المميّزة العام لدى NVIDIA عند إعداد مصادقة NVIDIA،
ويخزّنه مؤقتًا لمدة 24 ساعة. خيار الرجوع المضمّن القابل للاختيار هو
لقطة ثابتة من كتالوج النماذج المميّزة لدى NVIDIA؛ وتُخفى صفوف التوافق المهملة
ذات المراجعها الدقيقة من أدوات اختيار النماذج. تكون التكاليف افتراضيًا
0 في
المصدر، لأن NVIDIA توفّر حاليًا وصولًا مجانيًا عبر API للنماذج المدرجة.نقطة نهاية متوافقة مع OpenAI
نقطة نهاية متوافقة مع OpenAI
يتواصل OpenClaw مع NVIDIA باستخدام محوّل
openai-completions عبر
مسار إكمال المحادثات القياسي /v1. يُفترض أن تعمل أي أداة متوافقة مع OpenAI
مباشرةً باستخدام عنوان URL الأساسي لـ NVIDIA.معلمات استدلال Nemotron 3 Ultra
معلمات استدلال Nemotron 3 Ultra
يستخدم نموذج الطلب الخاص بـ Ultra من NVIDIA الحقلين يدمج
chat_template_kwargs.enable_thinking
وreasoning_budget لمخرجات الاستدلال. يعطّل صف Ultra المضمّن في OpenClaw
التفكير في القالب افتراضيًا لاستخدام المحادثة العادي. إذا كنت بحاجة إلى
تفعيل مخرجات الاستدلال من NVIDIA أو فرض حقول طلب أخرى خاصة بـ NVIDIA،
فعيّن معلمات لكل نموذج، واحصر التجاوزات الخاصة بالموفّر في
نموذج NVIDIA:params.chat_template_kwargs محتواه في أي chat_template_kwargs
موجودة مسبقًا في الطلب بدلًا من استبدال الكائن بالكامل.
يمثّل params.extra_body التجاوز النهائي لجسم الطلب المتوافق مع OpenAI،
ويستبدل مفاتيح الحمولة المتعارضة، لذا استخدمه فقط للحقول التي توثّقها NVIDIA
لنقطة النهاية المحددة.بطء استجابات الموفّر المخصص
بطء استجابات الموفّر المخصص
قد تستغرق بعض النماذج المخصصة المستضافة لدى NVIDIA وقتًا أطول من مهلة
مراقبة خمول النموذج الافتراضية البالغة نحو 120 ثانية قبل إصدار أول جزء من الاستجابة.
بالنسبة إلى إدخالات موفّر NVIDIA المخصص، ارفع مهلة الموفّر بدلًا من مهلة
وقت تشغيل الوكيل بالكامل؛ يغطي
timeoutSeconds طلبات HTTP الخاصة بالموفّر
ويرفع الحد الأقصى لمراقبة الخمول/البث لذلك الموفّر:ذو صلة
اختيار النموذج
اختيار الموفّرين ومراجع النماذج وسلوك تجاوز الفشل.
مرجع الإعداد
مرجع الإعداد الكامل للوكلاء والنماذج والموفّرين.