Skip to main content
ds4 स्थानीय Metal बैकएंड से DeepSeek V4 Flash को OpenAI-संगत /v1 API के माध्यम से उपलब्ध कराता है। OpenClaw सामान्य openai-completions प्रदाता परिवार के माध्यम से ds4 से कनेक्ट होता है। ds4 कोई बंडल किया गया OpenClaw प्रदाता Plugin नहीं है। इसे models.providers.ds4 के अंतर्गत कॉन्फ़िगर करें, फिर ds4/deepseek-v4-flash चुनें।

आवश्यकताएँ

  • Metal समर्थन वाला macOS।
  • ds4-server और DeepSeek V4 Flash GGUF फ़ाइल वाला कार्यशील ds4 चेकआउट।
  • आपके चुने हुए कॉन्टेक्स्ट के लिए पर्याप्त मेमोरी; बड़े --ctx मान सर्वर स्टार्टअप पर अधिक KV मेमोरी आवंटित करते हैं।
OpenClaw एजेंट टर्न में टूल स्कीमा और वर्कस्पेस कॉन्टेक्स्ट शामिल होते हैं। बहुत छोटा कॉन्टेक्स्ट, जैसे --ctx 4096, सीधे curl परीक्षणों में सफल हो सकता है, लेकिन पूर्ण एजेंट रन में 500 prompt exceeds context के साथ विफल हो सकता है। एजेंट और टूल स्मोक परीक्षणों के लिए कम-से-कम --ctx 32768 का उपयोग करें। --ctx 393216 का उपयोग केवल पर्याप्त मेमोरी होने पर और ds4 Think Max को सक्षम करने के लिए करें।

त्वरित शुरुआत

1

ds4-server शुरू करें

<DS4_DIR> को अपने ds4 चेकआउट पथ से बदलें।
2

OpenAI-संगत एंडपॉइंट सत्यापित करें

प्रतिक्रिया में deepseek-v4-flash शामिल होना चाहिए।
3

OpenClaw प्रदाता कॉन्फ़िगरेशन जोड़ें

पूर्ण कॉन्फ़िगरेशन से कॉन्फ़िगरेशन जोड़ें, फिर एकबारगी मॉडल जाँच चलाएँ:

पूर्ण कॉन्फ़िगरेशन

इस कॉन्फ़िगरेशन का उपयोग तब करें, जब ds4 पहले से 127.0.0.1:18000 पर चल रहा हो।
contextWindow को ds4-server --ctx के अनुरूप रखें। maxTokens को --tokens के अनुरूप रखें, जब तक कि आप जानबूझकर यह न चाहें कि OpenClaw सर्वर के डिफ़ॉल्ट से कम आउटपुट का अनुरोध करे।

माँग पर स्टार्टअप

OpenClaw केवल तब ds4 शुरू कर सकता है, जब कोई ds4/... मॉडल चुना गया हो। उसी प्रदाता प्रविष्टि में localService जोड़ें:
command एक निरपेक्ष निष्पादन योग्य पथ होना चाहिए। शेल लुकअप और ~ विस्तार का उपयोग नहीं किया जाता। प्रत्येक localService फ़ील्ड के लिए स्थानीय मॉडल सेवाएँ देखें।

Think Max

ds4 Think Max केवल तभी लागू करता है, जब ये दोनों सत्य हों:
  • ds4-server की शुरुआत --ctx 393216 या उससे अधिक से होती है।
  • अनुरोध reasoning_effort: "max" (या समतुल्य ds4 प्रयास फ़ील्ड) का उपयोग करता है।
यदि आप इतना बड़ा कॉन्टेक्स्ट चलाते हैं, तो सर्वर फ़्लैग और OpenClaw मॉडल मेटाडेटा दोनों अपडेट करें:

परीक्षण

OpenClaw को बायपास करते हुए सीधी HTTP जाँच:
OpenClaw मॉडल रूटिंग (त्वरित शुरुआत की जाँच के समान):
कम-से-कम 32768 कॉन्टेक्स्ट के साथ पूर्ण एजेंट और टूल-कॉल स्मोक परीक्षण:
अपेक्षित परिणाम:
  • executionTrace.winnerProvider, ds4 है
  • executionTrace.winnerModel, deepseek-v4-flash है
  • toolSummary.calls, कम-से-कम 1 है
  • finalAssistantVisibleText, tool-ok से शुरू होता है

समस्या निवारण

ds4 चल नहीं रहा है या baseUrl में दिए गए होस्ट/पोर्ट से बाउंड नहीं है। ds4-server शुरू करें, फिर पुनः प्रयास करें:
कॉन्फ़िगर किया गया --ctx OpenClaw टर्न के लिए बहुत छोटा है। ds4-server --ctx बढ़ाएँ, फिर उससे मेल खाने के लिए models.providers.ds4.models[].contextWindow अपडेट करें। टूल वाले पूर्ण एजेंट टर्न को सीधे एक-संदेश वाले curl अनुरोध की तुलना में काफ़ी अधिक कॉन्टेक्स्ट चाहिए।
ds4 Think Max का उपयोग केवल तब करता है, जब --ctx कम-से-कम 393216 हो और अनुरोध reasoning_effort: "max" माँगे। छोटे कॉन्टेक्स्ट उच्च रीजनिंग पर वापस चले जाते हैं।
ds4 में कोल्ड Metal रेज़िडेंसी और मॉडल वार्मअप चरण होता है। जब OpenClaw सर्वर को माँग पर शुरू करता है, तब localService.readyTimeoutMs: 300000 सेट करें।

संबंधित

स्थानीय मॉडल सेवाएँ

मॉडल अनुरोधों से पहले स्थानीय मॉडल सर्वर माँग पर शुरू करें।

स्थानीय मॉडल

स्थानीय मॉडल बैकएंड चुनें और संचालित करें।

मॉडल प्रदाता

प्रदाता संदर्भ, प्रमाणीकरण और फ़ेलओवर कॉन्फ़िगर करें।

DeepSeek

मूल DeepSeek प्रदाता व्यवहार और थिंकिंग नियंत्रण।