Skip to main content
models.providers.<id>.localService माँग पर प्रदाता-स्वामित्व वाला स्थानीय मॉडल सर्वर शुरू करता है। जब कोई मॉडल या एम्बेडिंग अनुरोध उस प्रदाता को चुनता है, तो OpenClaw स्वास्थ्य एंडपॉइंट की जाँच करता है, प्रक्रिया बंद होने पर उसे शुरू करता है, तत्परता की प्रतीक्षा करता है और फिर अनुरोध भेजता है। महँगे स्थानीय सर्वरों को पूरे दिन चालू रखने से बचने के लिए इसका उपयोग करें।

यह कैसे काम करता है

  1. कोई मॉडल या एम्बेडिंग अनुरोध कॉन्फ़िगर किए गए प्रदाता पर निर्धारित होता है।
  2. यदि उस प्रदाता में localService है, तो OpenClaw healthUrl की जाँच करता है।
  3. जाँच सफल होने पर OpenClaw पहले से चल रहे सर्वर का उपयोग करता है।
  4. जाँच विफल होने पर OpenClaw command को args के साथ शुरू करता है।
  5. OpenClaw स्वास्थ्य एंडपॉइंट की जाँच तब तक करता रहता है, जब तक readyTimeoutMs की अवधि समाप्त नहीं हो जाती।
  6. अनुरोध सामान्य मॉडल या एम्बेडिंग ट्रांसपोर्ट से होकर जाता है।
  7. यदि OpenClaw ने प्रक्रिया शुरू की है और idleStopMs सेट है, तो अंतिम प्रगतिरत अनुरोध के उतनी अवधि तक निष्क्रिय रहने के बाद यह प्रक्रिया रोक देता है।
OpenClaw इसके लिए launchd, systemd, Docker या कोई डेमन इंस्टॉल नहीं करता। सर्वर उस OpenClaw प्रक्रिया की सामान्य चाइल्ड प्रक्रिया होता है जिसे सबसे पहले इसकी आवश्यकता पड़ी थी। स्टार्टअप को प्रत्येक कॉन्फ़िगर किए गए प्रदाता और कमांड/आर्ग्युमेंट/पर्यावरण सेट के अनुसार क्रमबद्ध किया जाता है, इसलिए समान सेवा के लिए समवर्ती चैट और एम्बेडिंग अनुरोध डुप्लिकेट सर्वर शुरू नहीं करते। प्रतिक्रिया प्रबंधन पूरा होने तक प्रत्येक अनुरोध अपना अलग लीज़ बनाए रखता है, इसलिए निष्क्रियता के कारण शटडाउन प्रत्येक प्रगतिरत मॉडल और एम्बेडिंग अनुरोध के पूरा होने की प्रतीक्षा करता है। कॉन्फ़िगर किए गए प्रदाता उपनाम अलग बने रहते हैं: दो उपनाम समान Ollama, LM Studio या OpenAI-संगत अडैप्टर आईडी में समाहित हुए बिना अलग-अलग GPU होस्ट की ओर संकेत कर सकते हैं। यदि किसी अन्य OpenClaw प्रक्रिया के पास उसी healthUrl पर पहले से स्वस्थ सर्वर है, तो यह प्रक्रिया उसे अपनाए बिना पुनः उपयोग करती है (प्रत्येक प्रक्रिया केवल उसी चाइल्ड प्रक्रिया को प्रबंधित करती है जिसे उसने स्वयं शुरू किया हो)। स्टार्टअप और निकास लॉग में समय-सीमित, संशोधित चाइल्ड-आउटपुट के अंतिम अंश तथा समय और निकास विवरण शामिल होते हैं; कॉन्फ़िगर किए गए पर्यावरण मान कभी प्रदर्शित नहीं किए जाते।

कॉन्फ़िगरेशन संरचना

प्रदाता प्रविष्टि पर timeoutSeconds सेट करें (localService पर नहीं), ताकि धीमे कोल्ड स्टार्ट और लंबे जनरेशन डिफ़ॉल्ट मॉडल अनुरोध टाइमआउट तक न पहुँचें। जब भी आपका सर्वर बेस URL पर /models के अलावा किसी अन्य स्थान पर तत्परता प्रदर्शित करता हो, तो स्पष्ट healthUrl सेट करें।

फ़ील्ड

Inferrs उदाहरण

Inferrs एक कस्टम OpenAI-संगत /v1 बैकएंड है, इसलिए समान localService API, inferrs प्रदाता प्रविष्टि के साथ काम करता है:
command को OpenClaw चलाने वाली मशीन पर which inferrs के परिणाम से बदलें। Inferrs की पूरी सेटअप प्रक्रिया: Inferrs

ds4 उदाहरण

पूर्ण सेटअप, कॉन्टेक्स्ट आकार निर्धारण और सत्यापन कमांड: ds4

संबंधित

स्थानीय मॉडल

स्थानीय मॉडल सेटअप, प्रदाता विकल्प और सुरक्षा मार्गदर्शन।

Inferrs

Inferrs के OpenAI-संगत स्थानीय सर्वर के माध्यम से OpenClaw चलाएँ।