openai, का उपयोग करता है।
openai/* प्रामाणिक मॉडल रूट है।
रनटाइम नीति के अनिर्धारित या auto होने पर, एम्बेडेड एजेंट टर्न के लिए OpenAI के रूट
तथ्य तय करते हैं कि OpenClaw बंडल किए गए Codex ऐप-सर्वर रनटाइम को
अंतर्निहित रूप से चुन सकता है या नहीं। केवल openai/* उपसर्ग किसी रनटाइम का चयन नहीं करता।
- एजेंट मॉडल - स्पष्ट
agentRuntimeकॉन्फ़िगरेशन या OpenAI की अंतर्निहित रूट नीति द्वारा चुने गए रनटाइम के माध्यम सेopenai/*। ChatGPT/Codex सदस्यता उपयोग के लिए Codex प्रमाणीकरण से साइन इन करें, या कुंजी-आधारित बिलिंग चाहिए तो API-कुंजी प्रमाणीकरण प्रोफ़ाइल कॉन्फ़िगर करें। - गैर-एजेंट OpenAI API -
OPENAI_API_KEYया किसीopenaiAPI-कुंजी प्रमाणीकरण प्रोफ़ाइल के माध्यम से, प्रति उपयोग बिल किए जाने वाला प्रत्यक्ष OpenAI Platform एक्सेस। - लेगेसी कॉन्फ़िगरेशन -
codex/*औरopenai-codex/*संदर्भों कोopenclaw doctor --fixद्वाराopenai/*और मॉडल-स्कोप वालेagentRuntime.id: "codex"में सुधारा जाता है।
उपयोग और लागत ट्रैकिंग
OpenClaw सदस्यता कोटा और Platform API बिलिंग को अलग रखता है:- ChatGPT/Codex OAuth सदस्यता योजना, कोटा विंडो और क्रेडिट शेष दिखाता है।
OPENAI_ADMIN_KEYControl UI के उपयोग में प्रदाता द्वारा रिपोर्ट की गई संगठन लागत और पूर्णताओं के 30 दिनों के उपयोग को दिखाता है, जिसमें दैनिक खर्च, अनुरोध/टोकन योग, शीर्ष मॉडल और लागत श्रेणियाँ शामिल हैं।OPENAI_PROJECT_IDवैकल्पिक रूप से Admin API इतिहास को किसी एक प्रोजेक्ट तक सीमित करता है।- OpenClaw कभी भी
OPENAI_API_KEYया किसीopenaiअनुमान प्रोफ़ाइल को संगठन API पर नहीं भेजता; वे क्रेडेंशियल कस्टम, Azure या एजेंट-स्थानीय एंडपॉइंट से संबंधित हो सकते हैं।
त्वरित चयन
नामकरण मानचित्र
अंतर्निहित एजेंट रनटाइम
जब प्रदाता/मॉडलagentRuntime नीति अनिर्धारित या auto होती है, तब OpenAI की
प्रदाता-स्वामित्व वाली रूट नीति प्रभावी एंडपॉइंट और अडैप्टर से अंतर्निहित रनटाइम
चुनती है:
स्पष्ट गैर-डिफ़ॉल्ट प्रदाता/मॉडल
agentRuntime.id प्रामाणिक बना रहता है।
उदाहरण के लिए, agentRuntime.id: "openclaw" अन्यथा Codex-योग्य
रूट को OpenClaw पर बनाए रखता है, जबकि agentRuntime.id: "codex" Codex को अनिवार्य करता है और
प्रभावी रूट के Codex-संगत घोषित न होने पर बंद रहते हुए विफल होता है।
रनटाइम चयन क्रेडेंशियल प्रकार या बिलिंग नहीं बदलता: Platform API-कुंजी
प्रमाणीकरण और ChatGPT/Codex सदस्यता प्रमाणीकरण अलग बने रहते हैं।
openclaw doctor --fix लेगेसी codex/* और openai-codex/* मॉडल
संदर्भों, लेगेसी Codex प्रमाणीकरण प्रोफ़ाइल आईडी और लेगेसी Codex प्रमाणीकरण-क्रम प्रविष्टियों को
प्रामाणिक openai रूट में माइग्रेट करता है। माइग्रेट किए गए मॉडल संदर्भों को मॉडल-स्कोप वाला
agentRuntime.id: "codex" मिलता है; नए प्रमाणीकरण-क्रम कॉन्फ़िगरेशन के लिए auth.order.openai का उपयोग करें।
नया OpenAI सेटअप केवल तभी GPT-5.6 प्राथमिक मॉडल लागू करता है, जब कोई प्राथमिक मॉडल
कॉन्फ़िगर न हो। OpenAI प्रमाणीकरण जोड़ने या रीफ़्रेश करने पर मौजूदा स्पष्ट
चयन सुरक्षित रहता है, जिसमें
openai/gpt-5.5 भी शामिल है, जब तक कि आप स्पष्ट रूप से
models auth login --set-default या models set का उपयोग न करें। API-कुंजी प्रमाणीकरण प्रोफ़ाइल का
उपयोग केवल तभी करें, जब किसी एजेंट मॉडल के लिए API-कुंजी प्रमाणीकरण चाहिए।GPT-5.6 सीमित पूर्वावलोकन
OpenClaw सटीकopenai/gpt-5.6-sol,
openai/gpt-5.6-terra और openai/gpt-5.6-luna मॉडल आईडी पहचानता है। वर्तमान कैटलॉग में तीनों
xhigh और max रीजनिंग प्रदान करते हैं। OpenAI Sol को
प्रमुख टियर, Terra को संतुलित टियर और Luna को तेज़,
कम-लागत वाला टियर बताता है। देखें
GPT-5.6 लॉन्च घोषणा
और एक्सेस मार्गदर्शिका।
प्रत्यक्ष OpenAI API-कुंजी प्रमाणीकरण के साथ, केवल openai/gpt-5.6 आईडी Sol का उपनाम है
और नए सेटअप का डिफ़ॉल्ट है। नेटिव Codex कैटलॉग उस प्रत्यक्ष-API उपनाम को
क्लाइंट-पक्ष पर लागू नहीं करता; कार्यक्षेत्र एक्सेस के आधार पर, यह
सटीक Sol, Terra और Luna आईडी दिखा सकता है। इसलिए नया ChatGPT/Codex OAuth सेटअप
openai/gpt-5.6-sol का उपयोग करता है। वर्तमान खाते की जाँच इसके साथ करें:
रनटाइम नीति अनिर्धारित या
auto होने पर योग्य, सटीक आधिकारिक HTTPS रूट बंडल किए गए Codex ऐप-सर्वर
Plugin का चयन कर सकते हैं; लिखित Completions रूट,
कस्टम एंडपॉइंट और अनुरोध-परिवहन ओवरराइड OpenClaw पर बने रहते हैं। प्लेनटेक्स्ट
आधिकारिक HTTP एंडपॉइंट अस्वीकार किए जाते हैं। स्पष्ट प्रदाता/मॉडल रनटाइम कॉन्फ़िगरेशन
प्रामाणिक बना रहता है। पुराने लेगेसी Codex मॉडल
संदर्भों, codex-cli/* संदर्भों या ऐसे पुराने रनटाइम सत्र पिन को सुधारने के लिए openclaw doctor --fix चलाएँ, जिन्हें
स्पष्ट रनटाइम कॉन्फ़िगरेशन द्वारा सेट नहीं किया गया था।OpenClaw फ़ीचर कवरेज
OpenAI रीयलटाइम वॉइस सार्वजनिक OpenAI Platform Realtime
API से होकर जाती है और इसके लिए Platform API कुंजी आवश्यक है। इसके बजाय Codex OAuth टोकन
ChatGPT Codex बैकएंड को प्रमाणित करते हैं; सार्वजनिक Realtime एंडपॉइंट के लिए वे
Platform API कुंजियों के स्थान पर उपयोग नहीं किए जा सकते।यदि API-कुंजी प्रमाणीकरण में बिलिंग अनुपलब्ध होने की सूचना मिलती है, तो API-कुंजी
प्रमाणीकरण का उपयोग करते समय आपके रीयलटाइम क्रेडेंशियल का आधार बनने वाले संगठन के लिए
platform.openai.com/account/billing
पर Platform क्रेडिट बढ़ाएँ। रीयलटाइम वॉइस
openclaw onboard --auth-choice openai-api-key द्वारा बनाए गए
openai API-कुंजी प्रमाणीकरण प्रोफ़ाइल, Control UI Talk के लिए
talk.realtime.providers.openai.apiKey के माध्यम से सेट की गई Platform API कुंजी, या Voice
Call के लिए plugins.entries.voice-call.config.realtime.providers.openai.apiKey, अथवा OPENAI_API_KEY पर्यावरण चर को स्वीकार करती है।Control UI Video Talk में OpenAI WebRTC आवश्यकता होने पर कैमरा संदर्भ प्राप्त करता है:
जब मॉडल describe_view को कॉल करता है, तो ब्राउज़र रीयलटाइम डेटा चैनल पर
एक सीमित JPEG भेजता है। OpenClaw, OpenAI सत्र में निरंतर कैमरा ट्रैक
संलग्न नहीं करता।मेमोरी एम्बेडिंग
OpenClaw,memory_search इंडेक्सिंग और क्वेरी एम्बेडिंग के लिए
OpenAI या OpenAI-संगत एम्बेडिंग एंडपॉइंट का उपयोग कर सकता है:
memory.search के अंतर्गत queryInputType और documentInputType सेट करें। OpenClaw
इन्हें प्रदाता-विशिष्ट input_type अनुरोध फ़ील्ड के रूप में अग्रेषित करता है: क्वेरी
एम्बेडिंग queryInputType का उपयोग करती हैं; इंडेक्स किए गए मेमोरी खंड और बैच इंडेक्सिंग
documentInputType का उपयोग करते हैं। संपूर्ण उदाहरण के लिए
मेमोरी कॉन्फ़िगरेशन संदर्भ
देखें।
आरंभ करना
- API कुंजी (OpenAI Platform)
- Codex सदस्यता
इसके लिए सर्वोत्तम: प्रत्यक्ष API पहुँच और उपयोग-आधारित बिलिंग।या कुंजी सीधे दें:केवल प्रत्यक्ष-API वाला
1
अपनी API कुंजी प्राप्त करें
OpenAI Platform डैशबोर्ड से API कुंजी बनाएँ या कॉपी करें।
2
ऑनबोर्डिंग चलाएँ
3
सत्यापित करें कि मॉडल उपलब्ध है
रूट सारांश
runtime unset या
auto होने पर, केवल एक पात्र सटीक आधिकारिक HTTPS मूल
रूट ही Codex app-server हार्नेस को अंतर्निहित रूप से चुन सकता है। एजेंट मॉडल पर
API-कुंजी प्रमाणीकरण के लिए, openai API-कुंजी प्रमाणीकरण प्रोफ़ाइल बनाएँ और उसे
auth.order.openai के साथ क्रमबद्ध करें; गैर-एजेंट OpenAI API सतहों के लिए
OPENAI_API_KEY प्रत्यक्ष फ़ॉलबैक बना रहता है। पुराने
Codex प्रमाणीकरण-क्रम प्रविष्टियों को माइग्रेट करने के लिए openclaw doctor --fix चलाएँ।कॉन्फ़िगरेशन उदाहरण
gpt-5.6 id, Sol टियर में रिज़ॉल्व होता है। यदि यह API
संगठन GPT-5.6 उपलब्ध नहीं कराता, तो primary को स्पष्ट रूप से
openai/gpt-5.5 पर सेट करें।OpenAI API से ChatGPT का वर्तमान Instant मॉडल आज़माने के लिए, मॉडल को
openai/chat-latest पर सेट करें:chat-latest एक बदलता हुआ उपनाम है। इसके बजाय नया OpenAI API-कुंजी सेटअप
openai/gpt-5.6 का उपयोग करता है, जिसका केवल प्रत्यक्ष-API वाला id Sol में रिज़ॉल्व होता है। मौजूदा
स्पष्ट primary, जिनमें openai/gpt-5.5 भी शामिल है, अपरिवर्तित रहते हैं।
chat-latest उपनाम केवल medium टेक्स्ट वर्बोसिटी स्वीकार करता है; इस मॉडल के लिए OpenClaw
अनुरोध की गई किसी भी अन्य वर्बोसिटी को बलपूर्वक medium पर सेट करता है।मूल Codex ऐप-सर्वर प्रमाणीकरण
जब कोई योग्य सटीक आधिकारिक HTTPS रूट इसे अंतर्निहित रूप से चुनता है, या जब प्रदाता/मॉडलagentRuntime.id: "codex" इसे स्पष्ट रूप से चुनता है, तब मूल Codex
ऐप-सर्वर हार्नेस openai/* मॉडल रेफ़ का उपयोग करता है। इसका प्रमाणीकरण
फिर भी खाते पर आधारित होता है। OpenClaw इस क्रम में प्रमाणीकरण चुनता है:
- एजेंट के लिए क्रमबद्ध OpenAI प्रमाणीकरण प्रोफ़ाइल, अधिमानतः
auth.order.openaiके अंतर्गत। पुराने विरासती Codex प्रमाणीकरण प्रोफ़ाइल आईडी और प्रमाणीकरण क्रम को माइग्रेट करने के लिएopenclaw doctor --fixचलाएँ। - ऐप-सर्वर का मौजूदा खाता, जैसे स्थानीय Codex CLI ChatGPT साइन-इन। डिफ़ॉल्ट पृथक एजेंट होम के लिए, OpenClaw उस मूल CLI खाते को उसके लॉगिन RPC के माध्यम से ऐप-सर्वर में जोड़ता है; यह CLI के कॉन्फ़िगरेशन, plugins या थ्रेड स्टोर को साझा नहीं करता।
- केवल स्थानीय stdio ऐप-सर्वर लॉन्च के लिए, और केवल तब जब ऐप-सर्वर
कोई खाता रिपोर्ट न करे:
CODEX_API_KEY, फिरOPENAI_API_KEY।
OPENAI_API_KEY भी मौजूद है। env API-कुंजी फ़ॉलबैक केवल स्थानीय stdio
बिना-खाता पथ पर लागू होता है; इसे WebSocket ऐप-सर्वर कनेक्शन पर कभी नहीं भेजा
जाता। सदस्यता-शैली की Codex प्रोफ़ाइल चुने जाने पर, OpenClaw उत्पन्न की गई
stdio ऐप-सर्वर चाइल्ड प्रक्रिया से CODEX_API_KEY और OPENAI_API_KEY को भी
बाहर रखता है और इसके बजाय ऐप-सर्वर लॉगिन RPC के माध्यम से चयनित क्रेडेंशियल
भेजता है।
जब वह सदस्यता प्रोफ़ाइल Codex उपयोग सीमा के कारण अवरुद्ध होती है, तो OpenClaw
प्रोफ़ाइल को Codex द्वारा बताए गए रीसेट समय तक अवरुद्ध चिह्नित करता है और चयनित
मॉडल को बदले या Codex हार्नेस से बाहर निकले बिना प्रमाणीकरण क्रम को अगली
openai:* प्रोफ़ाइल पर घुमाने देता है। रीसेट समय बीतने के बाद सदस्यता
प्रोफ़ाइल फिर से योग्य हो जाती है।
छवि निर्माण
बंडल किया गयाopenai plugin image_generate टूल के माध्यम से
छवि निर्माण पंजीकृत करता है। यह समान openai/gpt-image-2 मॉडल रेफ़ के माध्यम से
OpenAI API-कुंजी और Codex OAuth, दोनों से छवि निर्माण का समर्थन करता है।
साझा टूल पैरामीटर, प्रदाता चयन और फ़ेलओवर व्यवहार के लिए
छवि निर्माण देखें।
gpt-image-2
डिफ़ॉल्ट है। gpt-image-1.5, gpt-image-1 और gpt-image-1-mini स्पष्ट
मॉडल ओवरराइड के रूप में उपयोग योग्य रहते हैं। पारदर्शी-पृष्ठभूमि PNG/WebP
आउटपुट के लिए openai/gpt-image-1.5 का उपयोग करें; वर्तमान gpt-image-2 API
background: "transparent" को अस्वीकार करता है।
पारदर्शी-पृष्ठभूमि अनुरोध के लिए, model: "openai/gpt-image-1.5", outputFormat: "png" या
"webp", और background: "transparent" के साथ image_generate को कॉल करें;
पुराना openai.background प्रदाता विकल्प अब भी स्वीकार किया जाता है। OpenClaw
डिफ़ॉल्ट openai/gpt-image-2 पारदर्शी अनुरोधों को gpt-image-1.5 में
पुनर्लिखकर सार्वजनिक OpenAI और OpenAI Codex OAuth रूट की भी सुरक्षा करता है;
Azure और कस्टम OpenAI-संगत एंडपॉइंट अपने कॉन्फ़िगर किए गए परिनियोजन/मॉडल नाम
बनाए रखते हैं।
हेडलेस CLI रन के लिए भी यही सेटिंग उपलब्ध है:
openclaw infer image edit के साथ समान
--output-format और --background फ़्लैग का उपयोग करें।
--openai-background OpenAI-विशिष्ट उपनाम के रूप में उपलब्ध रहता है। OpenAI
Images की गुणवत्ता और लागत नियंत्रित करने के लिए --quality low|medium|high|auto का उपयोग
करें। image generate या image edit में से OpenAI का मॉडरेशन संकेत
पास करने के लिए --openai-moderation low|auto का उपयोग करें।
ChatGPT/Codex OAuth इंस्टॉल के लिए, वही openai/gpt-image-2 संदर्भ रखें। जब
कोई openai OAuth प्रोफ़ाइल कॉन्फ़िगर की जाती है, तो OpenClaw उस संग्रहीत OAuth
एक्सेस टोकन को प्राप्त करता है और Codex Responses बैकएंड के माध्यम से इमेज अनुरोध भेजता है; यह
पहले OPENAI_API_KEY को आज़माता नहीं है और न ही चुपचाप किसी API कुंजी पर फ़ॉलबैक करता है।
जब इसके बजाय सीधे OpenAI Images API रूट का उपयोग करना हो, तो models.providers.openai को
API कुंजी, कस्टम बेस URL या Azure एंडपॉइंट के साथ स्पष्ट रूप से कॉन्फ़िगर करें।
यदि वह कस्टम इमेज एंडपॉइंट किसी विश्वसनीय LAN/निजी पते पर है, तो
browser.ssrfPolicy.dangerouslyAllowPrivateNetwork: true भी सेट करें; यह ऑप्ट-इन मौजूद न होने पर OpenClaw
निजी/आंतरिक OpenAI-संगत इमेज एंडपॉइंट को अवरुद्ध रखता है।
जनरेट करें:
वीडियो जनरेशन
बंडल किया गयाopenai Plugin
video_generate टूल के माध्यम से वीडियो जनरेशन पंजीकृत करता है।
OpenAI के इमेज-से-वीडियो अनुरोध इमेज
input_reference के साथ POST /v1/videos का उपयोग करते हैं।
एकल-वीडियो संपादन, अपलोड किए गए वीडियो को video फ़ील्ड में रखकर
POST /v1/videos/edits का उपयोग करते हैं।
साझा टूल पैरामीटर, प्रदाता चयन और फ़ेलओवर व्यवहार के लिए
वीडियो जनरेशन देखें।OpenAI प्रदाता
supportsSize घोषित करता है, लेकिन supportsAspectRatio या
supportsResolution नहीं। अनुरोध के प्रदाता तक पहुँचने से पहले OpenClaw की साझा
नॉर्मलाइज़ेशन परत अनुरोधित aspectRatio को निकटतम मेल खाने वाले OpenAI
size में बदल देती है, इसलिए आस्पेक्ट-रेशियो अनुरोध सामान्यतः फिर भी काम करते हैं।
resolution का कोई आकार फ़ॉलबैक नहीं है और इसे हटा दिया जाता है तथा कॉलर को
Ignored unsupported overrides for openai/<model>: resolution=<value> के रूप में दिखाया जाता है।GPT-5 प्रॉम्प्ट योगदान
OpenClaw,openai प्रदाता पर GPT-5-फ़ैमिली मॉडल के लिए एक साझा GPT-5
प्रॉम्प्ट योगदान जोड़ता है (इसमें मरम्मत से पहले के पुराने Codex संदर्भ भी शामिल हैं, जो
openai/* में नॉर्मलाइज़ होते हैं)। OpenRouter या opencode रूट जैसे अन्य प्रदाता,
जो GPT-5-फ़ैमिली मॉडल आईडी भी उपलब्ध कराते हैं, यह ओवरले प्राप्त नहीं करते; यह केवल मॉडल आईडी
पर नहीं, बल्कि प्रदाता आईडी openai पर आधारित है। पुराने GPT-4.x मॉडल इसे कभी
प्राप्त नहीं करते।
मूल Codex ऐप-सर्वर हार्नेस, डेवलपर निर्देशों के माध्यम से पर्सोना/टूल-अनुशासन व्यवहार अनुबंध
या मैत्रीपूर्ण इंटरैक्शन-शैली ओवरले प्राप्त नहीं करता; मूल Codex, Codex के स्वामित्व वाले बेस,
मॉडल और प्रोजेक्ट-दस्तावेज़ व्यवहार को बनाए रखता है, और OpenClaw मूल थ्रेड के लिए Codex की
अंतर्निहित पर्सनैलिटी अक्षम करता है, ताकि एजेंट कार्यस्थान की पर्सनैलिटी फ़ाइलें आधिकारिक बनी रहें।
OpenClaw मूल Codex थ्रेड में केवल रनटाइम संदर्भ का योगदान देता है: चैनल डिलीवरी, OpenClaw
डायनेमिक टूल, ACP डेलिगेशन, कार्यस्थान संदर्भ और OpenClaw Skills। इसी योगदान का
Heartbeat-मार्गदर्शन टेक्स्ट एकमात्र अपवाद है: मूल Codex Heartbeat टर्न को यह मिलता है,
जिसे साझा प्रॉम्प्ट-योगदान हुक के बजाय समर्पित सहयोग निर्देशों के रूप में इंजेक्ट किया जाता है।
GPT-5 योगदान मेल खाने वाले OpenClaw-संयोजित प्रॉम्प्ट में पर्सोना स्थायित्व,
निष्पादन सुरक्षा, टूल अनुशासन, आउटपुट आकार, पूर्णता जाँच और सत्यापन के लिए टैग किया गया
व्यवहार अनुबंध जोड़ता है। चैनल-विशिष्ट उत्तर और मौन-संदेश व्यवहार साझा OpenClaw सिस्टम
प्रॉम्प्ट और आउटबाउंड डिलीवरी नीति में रहते हैं। मैत्रीपूर्ण इंटरैक्शन-शैली परत अलग और
कॉन्फ़िगर करने योग्य है।
- कॉन्फ़िगरेशन
- CLI
जब साझा
agents.defaults.promptOverlays.gpt5.personality सेटिंग अनसेट होती है, तब पुराने
plugins.entries.openai.config.personality को अब भी संगतता फ़ॉलबैक के रूप में पढ़ा जाता है।आवाज़ और वाणी
वाणी संश्लेषण (TTS)
वाणी संश्लेषण (TTS)
बंडल किया गया
openai Plugin,
tts सतह के लिए वाणी संश्लेषण पंजीकृत करता है।उपलब्ध मॉडल:
gpt-4o-mini-tts, tts-1, tts-1-hd। उपलब्ध आवाज़ें:
alloy, ash, ballad, cedar, coral, echo, fable, juniper,
marin, onyx, nova, sage, shimmer, verse।extraBody को OpenClaw द्वारा जनरेट किए गए फ़ील्ड के बाद /audio/speech
अनुरोध JSON में मर्ज किया जाता है, इसलिए इसका उपयोग उन OpenAI-संगत एंडपॉइंट के लिए करें
जिन्हें lang जैसी अतिरिक्त कुंजियों की आवश्यकता होती है। प्रोटोटाइप कुंजियों
को अनदेखा किया जाता है।चैट API एंडपॉइंट को प्रभावित किए बिना TTS बेस URL को ओवरराइड करने के लिए
OPENAI_TTS_BASE_URL सेट करें। OpenAI TTS और Realtime आवाज़, दोनों को
OpenAI Platform API कुंजी के माध्यम से कॉन्फ़िगर किया जाता है; केवल OAuth वाले
इंस्टॉल अब भी Codex-समर्थित चैट मॉडल का उपयोग कर सकते हैं, लेकिन OpenAI लाइव
टॉक-बैक का नहीं।वाणी-से-टेक्स्ट
वाणी-से-टेक्स्ट
बंडल किया गया साझा ऑडियो मीडिया कॉन्फ़िगरेशन या प्रति-कॉल ट्रांसक्रिप्शन अनुरोध द्वारा दिए जाने पर
भाषा और प्रॉम्प्ट संकेत OpenAI को अग्रेषित किए जाते हैं।
openai Plugin, OpenClaw की मीडिया-अंडरस्टैंडिंग
ट्रांसक्रिप्शन सतह के माध्यम से बैच वाणी-से-टेक्स्ट पंजीकृत करता है।- डिफ़ॉल्ट मॉडल:
gpt-4o-transcribe - एंडपॉइंट: OpenAI REST
/v1/audio/transcriptions - इनपुट पथ: मल्टीपार्ट ऑडियो फ़ाइल अपलोड
- जहाँ भी इनबाउंड ऑडियो ट्रांसक्रिप्शन
tools.media.audioको पढ़ता है, वहाँ उपयोग किया जाता है, जिसमें Discord वॉइस-चैनल सेगमेंट और चैनल ऑडियो अटैचमेंट शामिल हैं
Realtime ट्रांसक्रिप्शन
Realtime ट्रांसक्रिप्शन
बंडल किया गया
openai Plugin, Voice Call Plugin के लिए
Realtime ट्रांसक्रिप्शन पंजीकृत करता है।G.711 u-law (
g711_ulaw / audio/pcmu) ऑडियो के साथ
wss://api.openai.com/v1/realtime से WebSocket कनेक्शन का उपयोग करता है। किसी
openai API-कुंजी प्रोफ़ाइल के लिए, Gateway WebSocket खोलने से पहले
एक अस्थायी Realtime ट्रांसक्रिप्शन क्लाइंट सीक्रेट बनाता है। यह स्ट्रीमिंग प्रदाता
Voice Call के Realtime ट्रांसक्रिप्शन पथ के लिए है; Discord वॉइस वर्तमान में छोटे
सेगमेंट रिकॉर्ड करता है और इसके बजाय बैच tools.media.audio ट्रांसक्रिप्शन पथ
का उपयोग करता है।Realtime आवाज़
Realtime आवाज़
बंडल किया गया
openai Plugin, Voice Call Plugin के लिए
Realtime आवाज़ पंजीकृत करता है।gpt-realtime-2.1 के लिए उपलब्ध अंतर्निहित Realtime वॉइस: alloy, ash,
ballad, coral, echo, sage, shimmer, verse, marin, cedar।
सर्वोत्तम Realtime गुणवत्ता के लिए OpenAI marin और cedar की अनुशंसा करता है। यह
ऊपर दी गई टेक्स्ट-टू-स्पीच वॉइस से अलग सेट है; केवल TTS वाली वॉइस,
जैसे fable, nova, या onyx, Realtime सत्रों के लिए मान्य नहीं है।
यदि आप छोटे, कम लागत वाले Realtime 2.1 वेरिएंट को प्राथमिकता देते हैं, तो मॉडल को स्पष्ट रूप से
gpt-realtime-2.1-mini पर सेट करें।GPT-Live (आगामी)। OpenAI के फ़ुल-डुप्लेक्स
gpt-live-1 और
gpt-live-1-mini मॉडल ने जुलाई 2026 में ChatGPT वॉइस मोड का स्थान लिया; डेवलपर
API को प्रारंभिक-पहुँच संगठनों के लिए क्रमिक रूप से उपलब्ध कराया जा रहा है। OpenClaw
मॉडल परिवार को पहचानता है, लेकिन इसे अभी चलाता नहीं है: GPT-Live सत्र
केवल WebRTC पर चलते हैं, अपना टर्न-टेकिंग स्वयं संभालते हैं (VAD नहीं), और एजेंट का कार्य
एक हैंडऑफ़ इवेंट प्रोटोकॉल के माध्यम से सौंपते हैं, जिसे OpenClaw के Realtime ट्रांसपोर्ट
अभी लागू नहीं करते। gpt-live-* मॉडल को कॉन्फ़िगर करने पर
एजेंट पहुँच के बिना ऑडियो से चुपचाप कनेक्ट होने के बजाय WebSocket ब्रिज और Talk ब्राउज़र
दोनों सत्रों के लिए मार्गदर्शन सहित बंद अवस्था में विफलता होती है।
प्रारंभिक पहुँच के दौरान API पहुँच भी प्रत्येक OpenAI संगठन के अनुसार नियंत्रित होती है।
GPT-Live समर्थन उपलब्ध होने तक gpt-realtime-2.1 (डिफ़ॉल्ट)
बनाए रखें।बैकएंड OpenAI Realtime ब्रिज GA Realtime WebSocket सत्र
संरचना का उपयोग करते हैं, जो
session.temperature स्वीकार नहीं करती। Azure OpenAI
डिप्लॉयमेंट azureEndpoint और azureDeployment के माध्यम से उपलब्ध रहते हैं और
डिप्लॉयमेंट-संगत सत्र संरचना (temperature सहित) बनाए रखते हैं।
द्विदिश टूल कॉलिंग और G.711 u-law ऑडियो का समर्थन करता है।सत्र बनाते समय Realtime वॉइस चुनी जाती है। OpenAI अधिकांश
सत्र फ़ील्ड को बाद में बदलने की अनुमति देता है, लेकिन उस सत्र में मॉडल द्वारा ऑडियो उत्सर्जित
करने के बाद वॉइस नहीं बदली जा सकती। OpenClaw वर्तमान में अंतर्निहित
Realtime वॉइस आईडी को स्ट्रिंग के रूप में प्रदर्शित करता है।
Control UI Talk, Gateway द्वारा जारी अस्थायी क्लाइंट सीक्रेट और OpenAI Realtime API
के साथ सीधे ब्राउज़र WebRTC SDP एक्सचेंज वाले OpenAI ब्राउज़र Realtime सत्रों का
उपयोग करता है। Gateway उस क्लाइंट सीक्रेट को चयनित
openai क्रेडेंशियल से जारी करता है। कॉन्फ़िगर की गई कुंजियाँ, API-कुंजी प्रोफ़ाइल और
OPENAI_API_KEY को प्राथमिकता मिलती है; openai OAuth प्रोफ़ाइल या बाहरी
Codex लॉगिन फ़ॉलबैक है। Gateway रिले और Voice Call बैकएंड Realtime
WebSocket ब्रिज मूल OpenAI एंडपॉइंट के लिए इसी क्रेडेंशियल क्रम का उपयोग करते हैं।
मेंटेनर का लाइव सत्यापन
OPENAI_API_KEY=... GEMINI_API_KEY=... node --import tsx scripts/dev/realtime-talk-live-smoke.ts के साथ उपलब्ध है;
OpenAI चरण सीक्रेट लॉग किए बिना बैकएंड WebSocket ब्रिज और ब्राउज़र
WebRTC SDP एक्सचेंज दोनों को सत्यापित करते हैं।
Google क्रेडेंशियल के बिना इन दोनों चरणों को चलाने के लिए --openai-only पास करें।Azure OpenAI एंडपॉइंट
बंडल किया गयाopenai प्रदाता बेस URL को ओवरराइड करके इमेज
जनरेशन के लिए Azure OpenAI संसाधन को लक्षित कर सकता है। इमेज-जनरेशन पथ पर, OpenClaw
models.providers.openai.baseUrl पर Azure होस्टनाम का पता लगाता है और
स्वचालित रूप से Azure की अनुरोध संरचना पर स्विच करता है।
Realtime वॉइस एक अलग कॉन्फ़िगरेशन पथ
(
plugins.entries.voice-call.config.realtime.providers.openai.azureEndpoint)
का उपयोग करती है और models.providers.openai.baseUrl से प्रभावित नहीं होती। इसकी Azure
सेटिंग के लिए वॉइस और स्पीच के अंतर्गत Realtime
वॉइस अकॉर्डियन देखें।- आपके पास पहले से Azure OpenAI सदस्यता, कोटा या एंटरप्राइज़ अनुबंध हो
- आपको क्षेत्रीय डेटा रेज़िडेंसी या Azure द्वारा प्रदान किए जाने वाले अनुपालन नियंत्रणों की आवश्यकता हो
- आप ट्रैफ़िक को मौजूदा Azure टेनेंसी के भीतर रखना चाहते हों
कॉन्फ़िगरेशन
बंडल किए गएopenai प्रदाता के माध्यम से Azure इमेज जनरेशन के लिए,
models.providers.openai.baseUrl को अपने Azure संसाधन पर इंगित करें और apiKey को
Azure OpenAI कुंजी पर सेट करें (OpenAI Platform कुंजी पर नहीं):
*.openai.azure.com*.services.ai.azure.com*.cognitiveservices.azure.com
Authorization: Bearerके बजायapi-keyहेडर भेजता है- डिप्लॉयमेंट-स्कोप वाले पथों (
/openai/deployments/{deployment}/...) का उपयोग करता है - प्रत्येक अनुरोध में
?api-version=...जोड़ता है - Azure इमेज-जनरेशन कॉल के लिए 600s की डिफ़ॉल्ट अनुरोध टाइमआउट अवधि का उपयोग करता है।
प्रत्येक कॉल के
timeoutMsमान फिर भी इस डिफ़ॉल्ट को ओवरराइड करते हैं।
openai प्रदाता के इमेज-जनरेशन पथ के लिए Azure रूटिंग हेतु
OpenClaw 2026.4.22 या बाद का संस्करण आवश्यक है। पहले के संस्करण किसी भी कस्टम
openai.baseUrl को सार्वजनिक OpenAI एंडपॉइंट की तरह मानते हैं और Azure इमेज
डिप्लॉयमेंट पर विफल होते हैं।API संस्करण
Azure इमेज-जनरेशन पथ के लिए किसी विशिष्ट Azure प्रीव्यू या GA संस्करण को पिन करने हेतुAZURE_OPENAI_API_VERSION सेट करें:
2024-12-01-preview है।
मॉडल नाम ही डिप्लॉयमेंट नाम हैं
Azure OpenAI मॉडल को डिप्लॉयमेंट से बाँधता है। बंडल किए गएopenai प्रदाता के माध्यम से रूट किए गए Azure इमेज-जनरेशन अनुरोधों के लिए, OpenClaw में
model फ़ील्ड वह Azure डिप्लॉयमेंट नाम होना चाहिए जिसे आपने Azure पोर्टल में
कॉन्फ़िगर किया है, न कि सार्वजनिक OpenAI मॉडल आईडी।
यदि आप gpt-image-2 प्रदान करने वाला gpt-image-2-prod नामक डिप्लॉयमेंट बनाते हैं:
openai प्रदाता के माध्यम से
रूट की गई प्रत्येक इमेज-जनरेशन कॉल पर लागू होता है।
क्षेत्रीय उपलब्धता
Azure इमेज जनरेशन वर्तमान में केवल कुछ क्षेत्रों में उपलब्ध है (उदाहरण के लिएeastus2, swedencentral, polandcentral, westus3,
uaenorth)। डिप्लॉयमेंट बनाने से पहले Microsoft की वर्तमान क्षेत्र सूची जाँचें
और पुष्टि करें कि विशिष्ट मॉडल आपके क्षेत्र में उपलब्ध है।
पैरामीटर अंतर
Azure OpenAI और सार्वजनिक OpenAI हमेशा समान इमेज पैरामीटर स्वीकार नहीं करते। Azure उन विकल्पों को अस्वीकार कर सकता है जिनकी सार्वजनिक OpenAI अनुमति देता है (उदाहरण के लिएgpt-image-2 पर कुछ background मान), या उन्हें केवल विशिष्ट मॉडल
संस्करणों पर उपलब्ध करा सकता है। ये अंतर Azure और अंतर्निहित मॉडल से आते हैं,
OpenClaw से नहीं। यदि कोई Azure अनुरोध सत्यापन त्रुटि के साथ विफल होता है, तो Azure पोर्टल में
अपने विशिष्ट डिप्लॉयमेंट और API संस्करण द्वारा समर्थित
पैरामीटर सेट जाँचें।
Azure OpenAI मूल ट्रांसपोर्ट और संगतता व्यवहार का उपयोग करता है, लेकिन उसे
OpenClaw के छिपे हुए एट्रिब्यूशन हेडर प्राप्त नहीं होते—उन्नत कॉन्फ़िगरेशन के अंतर्गत
मूल बनाम OpenAI-संगत
रूट अकॉर्डियन देखें।Azure पर चैट या Responses ट्रैफ़िक (इमेज जनरेशन से परे) के लिए,
ऑनबोर्डिंग प्रवाह या समर्पित Azure प्रदाता कॉन्फ़िग का उपयोग करें; केवल
openai.baseUrl
Azure API/प्रमाणीकरण संरचना को नहीं अपनाता। एक अलग
azure-openai-responses/* प्रदाता मौजूद है; नीचे Server-side compaction
अकॉर्डियन देखें।उन्नत कॉन्फ़िगरेशन
नीचे दिए गए प्रति-मॉडलparams उदाहरण OpenClaw के एम्बेडेड प्रदाता
अनुरोध को आकार देते हैं। इन्हें कॉन्फ़िगर करना स्वयं निर्धारित अनुरोध व्यवहार है, इसलिए अन्यथा पात्र
auto रूट Codex को अंतर्निहित रूप से चुनने के बजाय OpenClaw पर ही रहता है। मूल
Codex ऐप-सर्वर हार्नेस अपने ट्रांसपोर्ट और अनुरोध सेटिंग का स्वामी है; प्रभावी रूट को
Codex-संगत घोषित न किए जाने पर स्पष्ट
agentRuntime.id: "codex" बंद अवस्था में विफल होता है।
ट्रांसपोर्ट (WebSocket बनाम SSE)
ट्रांसपोर्ट (WebSocket बनाम SSE)
OpenClaw, संबंधित OpenAI दस्तावेज़:
openai/* के लिए SSE फ़ॉलबैक ("auto") के साथ WebSocket-प्रथम का उपयोग करता है।"auto" मोड में, OpenClaw:- SSE पर फ़ॉलबैक करने से पहले एक शुरुआती WebSocket विफलता पर दोबारा प्रयास करता है
- विफलता के बाद, WebSocket को 60 सेकंड के लिए अवनत चिह्नित करता है और कूल-डाउन के दौरान SSE का उपयोग करता है
- पुनः प्रयास और पुनः कनेक्शन के लिए स्थिर सत्र तथा टर्न पहचान हेडर संलग्न करता है
- ट्रांसपोर्ट वेरिएंट में उपयोग काउंटर (
input_tokens/prompt_tokens) को सामान्यीकृत करता है
तेज़ मोड
तेज़ मोड
OpenClaw,
openai/* के लिए एक साझा तेज़-मोड टॉगल उपलब्ध कराता है:- चैट/UI:
/fast status|auto|on|off - कॉन्फ़िग:
agents.defaults.models["<provider>/<model>"].params.fastMode
service_tier = "priority") से मैप करता है। मौजूदा service_tier मान
सुरक्षित रखे जाते हैं, और तेज़ मोड reasoning या
text.verbosity को दोबारा नहीं लिखता। fastMode: "auto" स्वतः कटऑफ़ तक नए मॉडल कॉल
तेज़ मोड में शुरू करता है, फिर बाद के पुनः प्रयास, फ़ॉलबैक, टूल-परिणाम या
निरंतरता कॉल तेज़ मोड के बिना शुरू करता है। कटऑफ़ का डिफ़ॉल्ट 60 सेकंड है;
इसे बदलने के लिए सक्रिय मॉडल पर params.fastAutoOnSeconds सेट करें।सत्र ओवरराइड को कॉन्फ़िग पर प्राथमिकता मिलती है। Sessions UI में सत्र ओवरराइड साफ़ करने पर
सत्र कॉन्फ़िगर किए गए डिफ़ॉल्ट पर लौट जाता है।
प्राथमिकता प्रोसेसिंग (service_tier)
प्राथमिकता प्रोसेसिंग (service_tier)
OpenAI का API समर्थित मान:
service_tier के माध्यम से प्राथमिकता प्रोसेसिंग उपलब्ध कराता है। इसे OpenClaw में
प्रत्येक मॉडल के लिए सेट करें:auto, default, flex, priority।सर्वर-साइड Compaction (Responses API)
सर्वर-साइड Compaction (Responses API)
प्रत्यक्ष OpenAI Responses मॉडल (
api.openai.com पर openai/*) के लिए,
OpenAI Plugin का OpenClaw स्ट्रीम रैपर सर्वर-साइड
Compaction को स्वतः सक्षम करता है:store: trueको अनिवार्य करता है (जब तक मॉडल संगतताsupportsStore: falseसेट न करे)context_management: [{ type: "compaction", compact_threshold: ... }]अंतःक्षेपित करता है- डिफ़ॉल्ट
compact_threshold:contextWindowका 70% (या अनुपलब्ध होने पर80000)
- स्पष्ट रूप से सक्षम करें
- कस्टम सीमा
- अक्षम करें
Azure OpenAI Responses जैसे संगत एंडपॉइंट के लिए उपयोगी:
responsesServerCompaction केवल context_management के अंतःक्षेपण को नियंत्रित करता है।
प्रत्यक्ष OpenAI Responses मॉडल तब भी store: true को अनिवार्य करते हैं, जब तक संगतता
supportsStore: false सेट न करे।सख्त-एजेंटिक GPT मोड
सख्त-एजेंटिक GPT मोड
OpenClaw के एम्बेडेड रनटाइम के माध्यम से चलने वाले
openai प्रदाता के GPT-5-परिवार मॉडल के लिए,
OpenClaw पहले से ही strict-agentic नामक अधिक सख्त निष्पादन अनुबंध को
डिफ़ॉल्ट रूप से उपयोग करता है। जब भी समाधान किया गया प्रदाता
openai हो और मॉडल आईडी GPT-5 परिवार से मेल खाती हो, यह स्वतः सक्रिय हो जाता है, जब तक कॉन्फ़िगरेशन
स्पष्ट रूप से इससे बाहर निकलने का विकल्प न चुने:"strict-agentic" को स्पष्ट रूप से सेट करने का समर्थित लेन पर कोई प्रभाव नहीं पड़ता (यह
पहले से ही डिफ़ॉल्ट है) और असमर्थित प्रदाता/मॉडल युग्मों पर यह निष्क्रिय रहता है।strict-agentic सक्रिय होने पर, OpenClaw:- पर्याप्त कार्य के लिए
update_planको स्वतः सक्षम करता है - संरचनात्मक रूप से खाली या केवल तर्क वाले टर्न को दृश्यमान-उत्तर निरंतरता के साथ पुनः प्रयास करता है
- चयनित हार्नेस द्वारा उपलब्ध कराए जाने पर स्पष्ट हार्नेस योजना इवेंट का उपयोग करता है
यह अनुबंध पूरी तरह OpenClaw के एम्बेडेड एजेंट रनर में स्थित है। यह
मूल Codex ऐप-सर्वर हार्नेस पर लागू नहीं होता, जो अपने टर्न और योजना
व्यवहार का स्वयं प्रबंधन करता है; मूल Codex रन के लिए निष्पादन-अनुबंध
सेटिंग की तुलना में हार्नेस का चयन अधिक महत्वपूर्ण है।
मूल बनाम OpenAI-संगत रूट
मूल बनाम OpenAI-संगत रूट
OpenClaw प्रत्यक्ष OpenAI, Codex और Azure OpenAI एंडपॉइंट को
सामान्य OpenAI-संगत
/v1 प्रॉक्सी से अलग तरीके से संभालता है:मूल रूट (openai/*, Azure OpenAI):reasoning: { effort: "none" }केवल उन मॉडलों के लिए रखता है जो OpenAInoneप्रयास का समर्थन करते हैं- उन मॉडलों या प्रॉक्सी के लिए अक्षम तर्क को छोड़ देता है जो
reasoning.effort: "none"को अस्वीकार करते हैं - टूल स्कीमा को डिफ़ॉल्ट रूप से सख्त मोड में रखता है
- छिपे हुए एट्रिब्यूशन हेडर केवल सत्यापित मूल होस्ट पर संलग्न करता है (Azure OpenAI को ये हेडर नहीं मिलते, भले ही वह एक मूल रूट हो)
- केवल-OpenAI अनुरोध आकार-निर्धारण (
service_tier,store, तर्क-संगतता, प्रॉम्प्ट-कैश संकेत) बनाए रखता है
- अधिक शिथिल संगतता व्यवहार का उपयोग करते हैं
- गैर-मूल
openai-completionsपेलोड से Completionsstoreहटाते हैं - OpenAI-संगत Completions प्रॉक्सी के लिए उन्नत
params.extra_body/params.extraBodyपास-थ्रू JSON स्वीकार करते हैं - vLLM जैसे OpenAI-संगत Completions
प्रॉक्सी के लिए
params.chat_template_kwargsस्वीकार करते हैं - सख्त टूल स्कीमा या केवल-मूल हेडर को अनिवार्य नहीं करते
संबंधित
मॉडल चयन
प्रदाताओं, मॉडल संदर्भों और फ़ेलओवर व्यवहार का चयन।
इमेज जनरेशन
साझा इमेज टूल पैरामीटर और प्रदाता चयन।
वीडियो जनरेशन
साझा वीडियो टूल पैरामीटर और प्रदाता चयन।
OAuth और प्रमाणीकरण
प्रमाणीकरण विवरण और क्रेडेंशियल के पुनः उपयोग के नियम।