/v1 API के पीछे उपलब्ध कराता है। OpenClaw सामान्य openai-completions अडैप्टर के माध्यम से इससे संचार करता है।
आरंभ करना
1
किसी मॉडल के साथ inferrs शुरू करें
2
सत्यापित करें कि सर्वर पहुँच योग्य है
3
OpenClaw प्रदाता प्रविष्टि जोड़ें
एक स्पष्ट प्रदाता प्रविष्टि जोड़ें और अपने डिफ़ॉल्ट मॉडल को उस पर इंगित करें। नीचे दिया गया कॉन्फ़िगरेशन उदाहरण देखें।
पूर्ण कॉन्फ़िगरेशन उदाहरण
स्थानीयinferrs सर्वर पर Gemma 4:
माँग पर स्टार्टअप
OpenClaw केवल तभीinferrs को स्वयं शुरू कर सकता है, जब कोई inferrs/... मॉडल चुना गया हो। उसी प्रदाता प्रविष्टि में localService जोड़ें:
command एक निरपेक्ष पथ होना चाहिए। Gateway होस्ट पर which inferrs चलाएँ और उस पथ का उपयोग करें। फ़ील्ड का पूर्ण संदर्भ: स्थानीय मॉडल सेवाएँ।
उन्नत कॉन्फ़िगरेशन
requiresStringContent क्यों महत्वपूर्ण है
requiresStringContent क्यों महत्वपूर्ण है
कुछ
inferrs Chat Completions रूट संरचित सामग्री-भाग सरणियों के बजाय केवल स्ट्रिंग messages[].content स्वीकार करते हैं।Gemma और टूल-स्कीमा संबंधी सावधानी
Gemma और टूल-स्कीमा संबंधी सावधानी
कुछ इससे अधिक सख्त स्थानीय बैकएंड पर प्रॉम्प्ट का दबाव कम होता है। यदि छोटे प्रत्यक्ष अनुरोध अब भी काम करते हैं, लेकिन सामान्य OpenClaw एजेंट टर्न
inferrs + Gemma संयोजन छोटे प्रत्यक्ष /v1/chat/completions अनुरोध स्वीकार करते हैं, लेकिन पूर्ण OpenClaw एजेंट-रनटाइम टर्न पर विफल हो जाते हैं। पहले टूल स्कीमा सतह को अक्षम करने का प्रयास करें:inferrs के भीतर लगातार क्रैश होते हैं, तो इसे OpenClaw ट्रांसपोर्ट समस्या के बजाय अपस्ट्रीम मॉडल/सर्वर की सीमा मानें।मैन्युअल स्मोक परीक्षण
मैन्युअल स्मोक परीक्षण
कॉन्फ़िगर करने के बाद दोनों स्तरों का परीक्षण करें:यदि पहला कमांड काम करता है, लेकिन दूसरा विफल होता है, तो नीचे समस्या निवारण देखें।
प्रॉक्सी-जैसा व्यवहार
प्रॉक्सी-जैसा व्यवहार
चूँकि
inferrs सामान्य openai-completions अडैप्टर का उपयोग करता है (openai-responses का नहीं), इसलिए केवल मूल OpenAI के लिए अनुरोध संरचना कभी लागू नहीं होती: कोई service_tier नहीं, कोई Responses store नहीं, कोई प्रॉम्प्ट-कैश संकेत नहीं, और कोई OpenAI रीजनिंग-संगत पेलोड संरचना नहीं भेजी जाती।समस्या निवारण
curl /v1/models विफल होता है
curl /v1/models विफल होता है
inferrs चल नहीं रहा है, पहुँच योग्य नहीं है, या आपके कॉन्फ़िगर किए गए होस्ट/पोर्ट से बँधा नहीं है। पुष्टि करें कि सर्वर शुरू है और उस पते पर अनुरोध सुन रहा है।messages[].content के लिए स्ट्रिंग अपेक्षित थी
messages[].content के लिए स्ट्रिंग अपेक्षित थी
मॉडल प्रविष्टि में
compat.requiresStringContent: true सेट करें (ऊपर देखें)।प्रत्यक्ष /v1/chat/completions कॉल सफल हैं, लेकिन openclaw infer model run विफल होता है
प्रत्यक्ष /v1/chat/completions कॉल सफल हैं, लेकिन openclaw infer model run विफल होता है
टूल स्कीमा सतह को अक्षम करने के लिए
compat.supportsTools: false सेट करें (ऊपर Gemma संबंधी सावधानी देखें)।बड़े एजेंट टर्न पर inferrs अब भी क्रैश होता है
बड़े एजेंट टर्न पर inferrs अब भी क्रैश होता है
यदि स्कीमा त्रुटियाँ समाप्त हो गई हैं, लेकिन
inferrs बड़े एजेंट टर्न पर अब भी क्रैश होता है, तो इसे अपस्ट्रीम inferrs या मॉडल की सीमा मानें। प्रॉम्प्ट का दबाव कम करें या बैकएंड/मॉडल बदलें।संबंधित
स्थानीय मॉडल
स्थानीय मॉडल सर्वरों के साथ OpenClaw चलाना।
स्थानीय मॉडल सेवाएँ
कॉन्फ़िगर किए गए प्रदाताओं के लिए माँग पर स्थानीय मॉडल सर्वर शुरू करना।
Gateway समस्या निवारण
उन स्थानीय OpenAI-संगत बैकएंड को डीबग करना जो जाँच में सफल होते हैं, लेकिन एजेंट रन में विफल होते हैं।
मॉडल चयन
सभी प्रदाताओं, मॉडल संदर्भों और फ़ेलओवर व्यवहार का अवलोकन।