Skip to main content
inferrs स्थानीय मॉडलों को OpenAI-संगत /v1 API के पीछे उपलब्ध कराता है। OpenClaw सामान्य openai-completions अडैप्टर के माध्यम से इससे संचार करता है।
inferrs एक कस्टम, स्वयं होस्ट किया गया OpenAI-संगत बैकएंड है, कोई समर्पित OpenClaw प्रदाता Plugin नहीं: इसे ऑनबोर्डिंग प्रमाणीकरण विकल्प चुनने के बजाय models.providers.inferrs के अंतर्गत कॉन्फ़िगर किया जाता है। स्वतः खोज वाले बंडल Plugin के लिए SGLang या vLLM देखें।

आरंभ करना

1

किसी मॉडल के साथ inferrs शुरू करें

2

सत्यापित करें कि सर्वर पहुँच योग्य है

3

OpenClaw प्रदाता प्रविष्टि जोड़ें

एक स्पष्ट प्रदाता प्रविष्टि जोड़ें और अपने डिफ़ॉल्ट मॉडल को उस पर इंगित करें। नीचे दिया गया कॉन्फ़िगरेशन उदाहरण देखें।

पूर्ण कॉन्फ़िगरेशन उदाहरण

स्थानीय inferrs सर्वर पर Gemma 4:

माँग पर स्टार्टअप

OpenClaw केवल तभी inferrs को स्वयं शुरू कर सकता है, जब कोई inferrs/... मॉडल चुना गया हो। उसी प्रदाता प्रविष्टि में localService जोड़ें:
command एक निरपेक्ष पथ होना चाहिए। Gateway होस्ट पर which inferrs चलाएँ और उस पथ का उपयोग करें। फ़ील्ड का पूर्ण संदर्भ: स्थानीय मॉडल सेवाएँ

उन्नत कॉन्फ़िगरेशन

कुछ inferrs Chat Completions रूट संरचित सामग्री-भाग सरणियों के बजाय केवल स्ट्रिंग messages[].content स्वीकार करते हैं।
यदि OpenClaw रन इस त्रुटि के साथ विफल होते हैं:
तो मॉडल प्रविष्टि में compat.requiresStringContent: true सेट करें। इसके बाद OpenClaw अनुरोध भेजने से पहले केवल-पाठ सामग्री भागों को साधारण स्ट्रिंग में समतल कर देता है।
कुछ inferrs + Gemma संयोजन छोटे प्रत्यक्ष /v1/chat/completions अनुरोध स्वीकार करते हैं, लेकिन पूर्ण OpenClaw एजेंट-रनटाइम टर्न पर विफल हो जाते हैं। पहले टूल स्कीमा सतह को अक्षम करने का प्रयास करें:
इससे अधिक सख्त स्थानीय बैकएंड पर प्रॉम्प्ट का दबाव कम होता है। यदि छोटे प्रत्यक्ष अनुरोध अब भी काम करते हैं, लेकिन सामान्य OpenClaw एजेंट टर्न inferrs के भीतर लगातार क्रैश होते हैं, तो इसे OpenClaw ट्रांसपोर्ट समस्या के बजाय अपस्ट्रीम मॉडल/सर्वर की सीमा मानें।
कॉन्फ़िगर करने के बाद दोनों स्तरों का परीक्षण करें:
यदि पहला कमांड काम करता है, लेकिन दूसरा विफल होता है, तो नीचे समस्या निवारण देखें।
चूँकि inferrs सामान्य openai-completions अडैप्टर का उपयोग करता है (openai-responses का नहीं), इसलिए केवल मूल OpenAI के लिए अनुरोध संरचना कभी लागू नहीं होती: कोई service_tier नहीं, कोई Responses store नहीं, कोई प्रॉम्प्ट-कैश संकेत नहीं, और कोई OpenAI रीजनिंग-संगत पेलोड संरचना नहीं भेजी जाती।

समस्या निवारण

inferrs चल नहीं रहा है, पहुँच योग्य नहीं है, या आपके कॉन्फ़िगर किए गए होस्ट/पोर्ट से बँधा नहीं है। पुष्टि करें कि सर्वर शुरू है और उस पते पर अनुरोध सुन रहा है।
मॉडल प्रविष्टि में compat.requiresStringContent: true सेट करें (ऊपर देखें)।
टूल स्कीमा सतह को अक्षम करने के लिए compat.supportsTools: false सेट करें (ऊपर Gemma संबंधी सावधानी देखें)।
यदि स्कीमा त्रुटियाँ समाप्त हो गई हैं, लेकिन inferrs बड़े एजेंट टर्न पर अब भी क्रैश होता है, तो इसे अपस्ट्रीम inferrs या मॉडल की सीमा मानें। प्रॉम्प्ट का दबाव कम करें या बैकएंड/मॉडल बदलें।
सामान्य सहायता के लिए समस्या निवारण और अक्सर पूछे जाने वाले प्रश्न देखें।

संबंधित

स्थानीय मॉडल

स्थानीय मॉडल सर्वरों के साथ OpenClaw चलाना।

स्थानीय मॉडल सेवाएँ

कॉन्फ़िगर किए गए प्रदाताओं के लिए माँग पर स्थानीय मॉडल सर्वर शुरू करना।

Gateway समस्या निवारण

उन स्थानीय OpenAI-संगत बैकएंड को डीबग करना जो जाँच में सफल होते हैं, लेकिन एजेंट रन में विफल होते हैं।

मॉडल चयन

सभी प्रदाताओं, मॉडल संदर्भों और फ़ेलओवर व्यवहार का अवलोकन।