Skip to main content
OpenClaw प्रत्यक्ष API-कुंजी प्रमाणीकरण और ChatGPT/Codex सदस्यता प्रमाणीकरण, दोनों के लिए एक ही प्रदाता आईडी, openai, का उपयोग करता है। openai/* प्रामाणिक मॉडल रूट है। रनटाइम नीति के अनिर्धारित या auto होने पर, एम्बेडेड एजेंट टर्न के लिए OpenAI के रूट तथ्य तय करते हैं कि OpenClaw बंडल किए गए Codex ऐप-सर्वर रनटाइम को अंतर्निहित रूप से चुन सकता है या नहीं। केवल openai/* उपसर्ग किसी रनटाइम का चयन नहीं करता।
  • एजेंट मॉडल - स्पष्ट agentRuntime कॉन्फ़िगरेशन या OpenAI की अंतर्निहित रूट नीति द्वारा चुने गए रनटाइम के माध्यम से openai/*। ChatGPT/Codex सदस्यता उपयोग के लिए Codex प्रमाणीकरण से साइन इन करें, या कुंजी-आधारित बिलिंग चाहिए तो API-कुंजी प्रमाणीकरण प्रोफ़ाइल कॉन्फ़िगर करें।
  • गैर-एजेंट OpenAI API - OPENAI_API_KEY या किसी openai API-कुंजी प्रमाणीकरण प्रोफ़ाइल के माध्यम से, प्रति उपयोग बिल किए जाने वाला प्रत्यक्ष OpenAI Platform एक्सेस।
  • लेगेसी कॉन्फ़िगरेशन - codex/* और openai-codex/* संदर्भों को openclaw doctor --fix द्वारा openai/* और मॉडल-स्कोप वाले agentRuntime.id: "codex" में सुधारा जाता है।
OpenAI बाहरी टूल और OpenClaw जैसे वर्कफ़्लो में सदस्यता OAuth के उपयोग का स्पष्ट रूप से समर्थन करता है।

उपयोग और लागत ट्रैकिंग

OpenClaw सदस्यता कोटा और Platform API बिलिंग को अलग रखता है:
  • ChatGPT/Codex OAuth सदस्यता योजना, कोटा विंडो और क्रेडिट शेष दिखाता है।
  • OPENAI_ADMIN_KEY Control UI के उपयोग में प्रदाता द्वारा रिपोर्ट की गई संगठन लागत और पूर्णताओं के 30 दिनों के उपयोग को दिखाता है, जिसमें दैनिक खर्च, अनुरोध/टोकन योग, शीर्ष मॉडल और लागत श्रेणियाँ शामिल हैं।
  • OPENAI_PROJECT_ID वैकल्पिक रूप से Admin API इतिहास को किसी एक प्रोजेक्ट तक सीमित करता है।
  • OpenClaw कभी भी OPENAI_API_KEY या किसी openai अनुमान प्रोफ़ाइल को संगठन API पर नहीं भेजता; वे क्रेडेंशियल कस्टम, Azure या एजेंट-स्थानीय एंडपॉइंट से संबंधित हो सकते हैं।
स्पष्ट Admin कुंजी को OAuth पर प्राथमिकता मिलती है। प्रदाता द्वारा रिपोर्ट किए गए इतिहास को OpenClaw की सत्र-व्युत्पन्न अनुमानित लागत के साथ मर्ज नहीं किया जाता; इसमें अन्य क्लाइंट की API गतिविधि और प्रदाता-पक्ष के बिलिंग समायोजन शामिल हो सकते हैं। OpenAI का API उपयोग डैशबोर्ड दस्तावेज़ उपयोग डेटा के लिए संगठन-स्वामी और स्पष्ट Usage Dashboard अनुमति आवश्यकताओं का वर्णन करता है। प्रदाता, मॉडल, रनटाइम और चैनल अलग-अलग परतें हैं। यदि ये लेबल आपस में मिल रहे हैं, तो कॉन्फ़िगरेशन बदलने से पहले एजेंट रनटाइम पढ़ें।

त्वरित चयन

नामकरण मानचित्र

अंतर्निहित एजेंट रनटाइम

जब प्रदाता/मॉडल agentRuntime नीति अनिर्धारित या auto होती है, तब OpenAI की प्रदाता-स्वामित्व वाली रूट नीति प्रभावी एंडपॉइंट और अडैप्टर से अंतर्निहित रनटाइम चुनती है: स्पष्ट गैर-डिफ़ॉल्ट प्रदाता/मॉडल agentRuntime.id प्रामाणिक बना रहता है। उदाहरण के लिए, agentRuntime.id: "openclaw" अन्यथा Codex-योग्य रूट को OpenClaw पर बनाए रखता है, जबकि agentRuntime.id: "codex" Codex को अनिवार्य करता है और प्रभावी रूट के Codex-संगत घोषित न होने पर बंद रहते हुए विफल होता है। रनटाइम चयन क्रेडेंशियल प्रकार या बिलिंग नहीं बदलता: Platform API-कुंजी प्रमाणीकरण और ChatGPT/Codex सदस्यता प्रमाणीकरण अलग बने रहते हैं। openclaw doctor --fix लेगेसी codex/* और openai-codex/* मॉडल संदर्भों, लेगेसी Codex प्रमाणीकरण प्रोफ़ाइल आईडी और लेगेसी Codex प्रमाणीकरण-क्रम प्रविष्टियों को प्रामाणिक openai रूट में माइग्रेट करता है। माइग्रेट किए गए मॉडल संदर्भों को मॉडल-स्कोप वाला agentRuntime.id: "codex" मिलता है; नए प्रमाणीकरण-क्रम कॉन्फ़िगरेशन के लिए auth.order.openai का उपयोग करें।
नया OpenAI सेटअप केवल तभी GPT-5.6 प्राथमिक मॉडल लागू करता है, जब कोई प्राथमिक मॉडल कॉन्फ़िगर न हो। OpenAI प्रमाणीकरण जोड़ने या रीफ़्रेश करने पर मौजूदा स्पष्ट चयन सुरक्षित रहता है, जिसमें openai/gpt-5.5 भी शामिल है, जब तक कि आप स्पष्ट रूप से models auth login --set-default या models set का उपयोग न करें। API-कुंजी प्रमाणीकरण प्रोफ़ाइल का उपयोग केवल तभी करें, जब किसी एजेंट मॉडल के लिए API-कुंजी प्रमाणीकरण चाहिए।

GPT-5.6 सीमित पूर्वावलोकन

OpenClaw सटीक openai/gpt-5.6-sol, openai/gpt-5.6-terra और openai/gpt-5.6-luna मॉडल आईडी पहचानता है। वर्तमान कैटलॉग में तीनों xhigh और max रीजनिंग प्रदान करते हैं। OpenAI Sol को प्रमुख टियर, Terra को संतुलित टियर और Luna को तेज़, कम-लागत वाला टियर बताता है। देखें GPT-5.6 लॉन्च घोषणा और एक्सेस मार्गदर्शिका प्रत्यक्ष OpenAI API-कुंजी प्रमाणीकरण के साथ, केवल openai/gpt-5.6 आईडी Sol का उपनाम है और नए सेटअप का डिफ़ॉल्ट है। नेटिव Codex कैटलॉग उस प्रत्यक्ष-API उपनाम को क्लाइंट-पक्ष पर लागू नहीं करता; कार्यक्षेत्र एक्सेस के आधार पर, यह सटीक Sol, Terra और Luna आईडी दिखा सकता है। इसलिए नया ChatGPT/Codex OAuth सेटअप openai/gpt-5.6-sol का उपयोग करता है। वर्तमान खाते की जाँच इसके साथ करें:
API संगठन और Codex कार्यक्षेत्र एक्सेस अलग हो सकते हैं। यदि GPT-5.6 उपलब्ध नहीं है, तो GPT-5.5 को स्पष्ट रूप से चुनें:
OpenClaw अपस्ट्रीम एक्सेस त्रुटि दिखाता है और GPT-5.6 चयन को चुपचाप GPT-5.5 से प्रतिस्थापित नहीं करता।
रनटाइम नीति अनिर्धारित या auto होने पर योग्य, सटीक आधिकारिक HTTPS रूट बंडल किए गए Codex ऐप-सर्वर Plugin का चयन कर सकते हैं; लिखित Completions रूट, कस्टम एंडपॉइंट और अनुरोध-परिवहन ओवरराइड OpenClaw पर बने रहते हैं। प्लेनटेक्स्ट आधिकारिक HTTP एंडपॉइंट अस्वीकार किए जाते हैं। स्पष्ट प्रदाता/मॉडल रनटाइम कॉन्फ़िगरेशन प्रामाणिक बना रहता है। पुराने लेगेसी Codex मॉडल संदर्भों, codex-cli/* संदर्भों या ऐसे पुराने रनटाइम सत्र पिन को सुधारने के लिए openclaw doctor --fix चलाएँ, जिन्हें स्पष्ट रनटाइम कॉन्फ़िगरेशन द्वारा सेट नहीं किया गया था।

OpenClaw फ़ीचर कवरेज

OpenAI रीयलटाइम वॉइस सार्वजनिक OpenAI Platform Realtime API से होकर जाती है और इसके लिए Platform API कुंजी आवश्यक है। इसके बजाय Codex OAuth टोकन ChatGPT Codex बैकएंड को प्रमाणित करते हैं; सार्वजनिक Realtime एंडपॉइंट के लिए वे Platform API कुंजियों के स्थान पर उपयोग नहीं किए जा सकते।यदि API-कुंजी प्रमाणीकरण में बिलिंग अनुपलब्ध होने की सूचना मिलती है, तो API-कुंजी प्रमाणीकरण का उपयोग करते समय आपके रीयलटाइम क्रेडेंशियल का आधार बनने वाले संगठन के लिए platform.openai.com/account/billing पर Platform क्रेडिट बढ़ाएँ। रीयलटाइम वॉइस openclaw onboard --auth-choice openai-api-key द्वारा बनाए गए openai API-कुंजी प्रमाणीकरण प्रोफ़ाइल, Control UI Talk के लिए talk.realtime.providers.openai.apiKey के माध्यम से सेट की गई Platform API कुंजी, या Voice Call के लिए plugins.entries.voice-call.config.realtime.providers.openai.apiKey, अथवा OPENAI_API_KEY पर्यावरण चर को स्वीकार करती है।Control UI Video Talk में OpenAI WebRTC आवश्यकता होने पर कैमरा संदर्भ प्राप्त करता है: जब मॉडल describe_view को कॉल करता है, तो ब्राउज़र रीयलटाइम डेटा चैनल पर एक सीमित JPEG भेजता है। OpenClaw, OpenAI सत्र में निरंतर कैमरा ट्रैक संलग्न नहीं करता।

मेमोरी एम्बेडिंग

OpenClaw, memory_search इंडेक्सिंग और क्वेरी एम्बेडिंग के लिए OpenAI या OpenAI-संगत एम्बेडिंग एंडपॉइंट का उपयोग कर सकता है:
असममित एम्बेडिंग लेबल की आवश्यकता वाले OpenAI-संगत एंडपॉइंट के लिए, memory.search के अंतर्गत queryInputType और documentInputType सेट करें। OpenClaw इन्हें प्रदाता-विशिष्ट input_type अनुरोध फ़ील्ड के रूप में अग्रेषित करता है: क्वेरी एम्बेडिंग queryInputType का उपयोग करती हैं; इंडेक्स किए गए मेमोरी खंड और बैच इंडेक्सिंग documentInputType का उपयोग करते हैं। संपूर्ण उदाहरण के लिए मेमोरी कॉन्फ़िगरेशन संदर्भ देखें।

आरंभ करना

इसके लिए सर्वोत्तम: प्रत्यक्ष API पहुँच और उपयोग-आधारित बिलिंग।
1

अपनी API कुंजी प्राप्त करें

OpenAI Platform डैशबोर्ड से API कुंजी बनाएँ या कॉपी करें।
2

ऑनबोर्डिंग चलाएँ

या कुंजी सीधे दें:
3

सत्यापित करें कि मॉडल उपलब्ध है

रूट सारांश

runtime unset या auto होने पर, केवल एक पात्र सटीक आधिकारिक HTTPS मूल रूट ही Codex app-server हार्नेस को अंतर्निहित रूप से चुन सकता है। एजेंट मॉडल पर API-कुंजी प्रमाणीकरण के लिए, openai API-कुंजी प्रमाणीकरण प्रोफ़ाइल बनाएँ और उसे auth.order.openai के साथ क्रमबद्ध करें; गैर-एजेंट OpenAI API सतहों के लिए OPENAI_API_KEY प्रत्यक्ष फ़ॉलबैक बना रहता है। पुराने Codex प्रमाणीकरण-क्रम प्रविष्टियों को माइग्रेट करने के लिए openclaw doctor --fix चलाएँ।

कॉन्फ़िगरेशन उदाहरण

केवल प्रत्यक्ष-API वाला gpt-5.6 id, Sol टियर में रिज़ॉल्व होता है। यदि यह API संगठन GPT-5.6 उपलब्ध नहीं कराता, तो primary को स्पष्ट रूप से openai/gpt-5.5 पर सेट करें।OpenAI API से ChatGPT का वर्तमान Instant मॉडल आज़माने के लिए, मॉडल को openai/chat-latest पर सेट करें:
chat-latest एक बदलता हुआ उपनाम है। इसके बजाय नया OpenAI API-कुंजी सेटअप openai/gpt-5.6 का उपयोग करता है, जिसका केवल प्रत्यक्ष-API वाला id Sol में रिज़ॉल्व होता है। मौजूदा स्पष्ट primary, जिनमें openai/gpt-5.5 भी शामिल है, अपरिवर्तित रहते हैं। chat-latest उपनाम केवल medium टेक्स्ट वर्बोसिटी स्वीकार करता है; इस मॉडल के लिए OpenClaw अनुरोध की गई किसी भी अन्य वर्बोसिटी को बलपूर्वक medium पर सेट करता है।
OpenClaw प्रत्यक्ष OpenAI API-कुंजी रूट पर gpt-5.3-codex-spark उपलब्ध नहीं कराता। यह केवल Codex सदस्यता कैटलॉग प्रविष्टियों के माध्यम से उपलब्ध होता है, जब आपका साइन-इन किया हुआ खाता इसे उपलब्ध कराता हो।

मूल Codex ऐप-सर्वर प्रमाणीकरण

जब कोई योग्य सटीक आधिकारिक HTTPS रूट इसे अंतर्निहित रूप से चुनता है, या जब प्रदाता/मॉडल agentRuntime.id: "codex" इसे स्पष्ट रूप से चुनता है, तब मूल Codex ऐप-सर्वर हार्नेस openai/* मॉडल रेफ़ का उपयोग करता है। इसका प्रमाणीकरण फिर भी खाते पर आधारित होता है। OpenClaw इस क्रम में प्रमाणीकरण चुनता है:
  1. एजेंट के लिए क्रमबद्ध OpenAI प्रमाणीकरण प्रोफ़ाइल, अधिमानतः auth.order.openai के अंतर्गत। पुराने विरासती Codex प्रमाणीकरण प्रोफ़ाइल आईडी और प्रमाणीकरण क्रम को माइग्रेट करने के लिए openclaw doctor --fix चलाएँ।
  2. ऐप-सर्वर का मौजूदा खाता, जैसे स्थानीय Codex CLI ChatGPT साइन-इन। डिफ़ॉल्ट पृथक एजेंट होम के लिए, OpenClaw उस मूल CLI खाते को उसके लॉगिन RPC के माध्यम से ऐप-सर्वर में जोड़ता है; यह CLI के कॉन्फ़िगरेशन, plugins या थ्रेड स्टोर को साझा नहीं करता।
  3. केवल स्थानीय stdio ऐप-सर्वर लॉन्च के लिए, और केवल तब जब ऐप-सर्वर कोई खाता रिपोर्ट न करे: CODEX_API_KEY, फिर OPENAI_API_KEY
स्थानीय ChatGPT/Codex सदस्यता साइन-इन को केवल इसलिए प्रतिस्थापित नहीं किया जाता क्योंकि Gateway प्रक्रिया में प्रत्यक्ष OpenAI मॉडल या एम्बेडिंग के लिए OPENAI_API_KEY भी मौजूद है। env API-कुंजी फ़ॉलबैक केवल स्थानीय stdio बिना-खाता पथ पर लागू होता है; इसे WebSocket ऐप-सर्वर कनेक्शन पर कभी नहीं भेजा जाता। सदस्यता-शैली की Codex प्रोफ़ाइल चुने जाने पर, OpenClaw उत्पन्न की गई stdio ऐप-सर्वर चाइल्ड प्रक्रिया से CODEX_API_KEY और OPENAI_API_KEY को भी बाहर रखता है और इसके बजाय ऐप-सर्वर लॉगिन RPC के माध्यम से चयनित क्रेडेंशियल भेजता है। जब वह सदस्यता प्रोफ़ाइल Codex उपयोग सीमा के कारण अवरुद्ध होती है, तो OpenClaw प्रोफ़ाइल को Codex द्वारा बताए गए रीसेट समय तक अवरुद्ध चिह्नित करता है और चयनित मॉडल को बदले या Codex हार्नेस से बाहर निकले बिना प्रमाणीकरण क्रम को अगली openai:* प्रोफ़ाइल पर घुमाने देता है। रीसेट समय बीतने के बाद सदस्यता प्रोफ़ाइल फिर से योग्य हो जाती है।

छवि निर्माण

बंडल किया गया openai plugin image_generate टूल के माध्यम से छवि निर्माण पंजीकृत करता है। यह समान openai/gpt-image-2 मॉडल रेफ़ के माध्यम से OpenAI API-कुंजी और Codex OAuth, दोनों से छवि निर्माण का समर्थन करता है।
साझा टूल पैरामीटर, प्रदाता चयन और फ़ेलओवर व्यवहार के लिए छवि निर्माण देखें।
OpenAI टेक्स्ट-से-छवि निर्माण और छवि संपादन के लिए gpt-image-2 डिफ़ॉल्ट है। gpt-image-1.5, gpt-image-1 और gpt-image-1-mini स्पष्ट मॉडल ओवरराइड के रूप में उपयोग योग्य रहते हैं। पारदर्शी-पृष्ठभूमि PNG/WebP आउटपुट के लिए openai/gpt-image-1.5 का उपयोग करें; वर्तमान gpt-image-2 API background: "transparent" को अस्वीकार करता है। पारदर्शी-पृष्ठभूमि अनुरोध के लिए, model: "openai/gpt-image-1.5", outputFormat: "png" या "webp", और background: "transparent" के साथ image_generate को कॉल करें; पुराना openai.background प्रदाता विकल्प अब भी स्वीकार किया जाता है। OpenClaw डिफ़ॉल्ट openai/gpt-image-2 पारदर्शी अनुरोधों को gpt-image-1.5 में पुनर्लिखकर सार्वजनिक OpenAI और OpenAI Codex OAuth रूट की भी सुरक्षा करता है; Azure और कस्टम OpenAI-संगत एंडपॉइंट अपने कॉन्फ़िगर किए गए परिनियोजन/मॉडल नाम बनाए रखते हैं। हेडलेस CLI रन के लिए भी यही सेटिंग उपलब्ध है:
इनपुट फ़ाइल से शुरू करते समय openclaw infer image edit के साथ समान --output-format और --background फ़्लैग का उपयोग करें। --openai-background OpenAI-विशिष्ट उपनाम के रूप में उपलब्ध रहता है। OpenAI Images की गुणवत्ता और लागत नियंत्रित करने के लिए --quality low|medium|high|auto का उपयोग करें। image generate या image edit में से OpenAI का मॉडरेशन संकेत पास करने के लिए --openai-moderation low|auto का उपयोग करें। ChatGPT/Codex OAuth इंस्टॉल के लिए, वही openai/gpt-image-2 संदर्भ रखें। जब कोई openai OAuth प्रोफ़ाइल कॉन्फ़िगर की जाती है, तो OpenClaw उस संग्रहीत OAuth एक्सेस टोकन को प्राप्त करता है और Codex Responses बैकएंड के माध्यम से इमेज अनुरोध भेजता है; यह पहले OPENAI_API_KEY को आज़माता नहीं है और न ही चुपचाप किसी API कुंजी पर फ़ॉलबैक करता है। जब इसके बजाय सीधे OpenAI Images API रूट का उपयोग करना हो, तो models.providers.openai को API कुंजी, कस्टम बेस URL या Azure एंडपॉइंट के साथ स्पष्ट रूप से कॉन्फ़िगर करें। यदि वह कस्टम इमेज एंडपॉइंट किसी विश्वसनीय LAN/निजी पते पर है, तो browser.ssrfPolicy.dangerouslyAllowPrivateNetwork: true भी सेट करें; यह ऑप्ट-इन मौजूद न होने पर OpenClaw निजी/आंतरिक OpenAI-संगत इमेज एंडपॉइंट को अवरुद्ध रखता है। जनरेट करें:
पारदर्शी PNG जनरेट करें:
संपादित करें:

वीडियो जनरेशन

बंडल किया गया openai Plugin video_generate टूल के माध्यम से वीडियो जनरेशन पंजीकृत करता है। OpenAI के इमेज-से-वीडियो अनुरोध इमेज input_reference के साथ POST /v1/videos का उपयोग करते हैं। एकल-वीडियो संपादन, अपलोड किए गए वीडियो को video फ़ील्ड में रखकर POST /v1/videos/edits का उपयोग करते हैं।
साझा टूल पैरामीटर, प्रदाता चयन और फ़ेलओवर व्यवहार के लिए वीडियो जनरेशन देखें।OpenAI प्रदाता supportsSize घोषित करता है, लेकिन supportsAspectRatio या supportsResolution नहीं। अनुरोध के प्रदाता तक पहुँचने से पहले OpenClaw की साझा नॉर्मलाइज़ेशन परत अनुरोधित aspectRatio को निकटतम मेल खाने वाले OpenAI size में बदल देती है, इसलिए आस्पेक्ट-रेशियो अनुरोध सामान्यतः फिर भी काम करते हैं। resolution का कोई आकार फ़ॉलबैक नहीं है और इसे हटा दिया जाता है तथा कॉलर को Ignored unsupported overrides for openai/<model>: resolution=<value> के रूप में दिखाया जाता है।

GPT-5 प्रॉम्प्ट योगदान

OpenClaw, openai प्रदाता पर GPT-5-फ़ैमिली मॉडल के लिए एक साझा GPT-5 प्रॉम्प्ट योगदान जोड़ता है (इसमें मरम्मत से पहले के पुराने Codex संदर्भ भी शामिल हैं, जो openai/* में नॉर्मलाइज़ होते हैं)। OpenRouter या opencode रूट जैसे अन्य प्रदाता, जो GPT-5-फ़ैमिली मॉडल आईडी भी उपलब्ध कराते हैं, यह ओवरले प्राप्त नहीं करते; यह केवल मॉडल आईडी पर नहीं, बल्कि प्रदाता आईडी openai पर आधारित है। पुराने GPT-4.x मॉडल इसे कभी प्राप्त नहीं करते। मूल Codex ऐप-सर्वर हार्नेस, डेवलपर निर्देशों के माध्यम से पर्सोना/टूल-अनुशासन व्यवहार अनुबंध या मैत्रीपूर्ण इंटरैक्शन-शैली ओवरले प्राप्त नहीं करता; मूल Codex, Codex के स्वामित्व वाले बेस, मॉडल और प्रोजेक्ट-दस्तावेज़ व्यवहार को बनाए रखता है, और OpenClaw मूल थ्रेड के लिए Codex की अंतर्निहित पर्सनैलिटी अक्षम करता है, ताकि एजेंट कार्यस्थान की पर्सनैलिटी फ़ाइलें आधिकारिक बनी रहें। OpenClaw मूल Codex थ्रेड में केवल रनटाइम संदर्भ का योगदान देता है: चैनल डिलीवरी, OpenClaw डायनेमिक टूल, ACP डेलिगेशन, कार्यस्थान संदर्भ और OpenClaw Skills। इसी योगदान का Heartbeat-मार्गदर्शन टेक्स्ट एकमात्र अपवाद है: मूल Codex Heartbeat टर्न को यह मिलता है, जिसे साझा प्रॉम्प्ट-योगदान हुक के बजाय समर्पित सहयोग निर्देशों के रूप में इंजेक्ट किया जाता है। GPT-5 योगदान मेल खाने वाले OpenClaw-संयोजित प्रॉम्प्ट में पर्सोना स्थायित्व, निष्पादन सुरक्षा, टूल अनुशासन, आउटपुट आकार, पूर्णता जाँच और सत्यापन के लिए टैग किया गया व्यवहार अनुबंध जोड़ता है। चैनल-विशिष्ट उत्तर और मौन-संदेश व्यवहार साझा OpenClaw सिस्टम प्रॉम्प्ट और आउटबाउंड डिलीवरी नीति में रहते हैं। मैत्रीपूर्ण इंटरैक्शन-शैली परत अलग और कॉन्फ़िगर करने योग्य है।
रनटाइम पर मान केस-असंवेदी होते हैं, इसलिए "Off" और "off" दोनों मैत्रीपूर्ण शैली परत को अक्षम करते हैं।
जब साझा agents.defaults.promptOverlays.gpt5.personality सेटिंग अनसेट होती है, तब पुराने plugins.entries.openai.config.personality को अब भी संगतता फ़ॉलबैक के रूप में पढ़ा जाता है।

आवाज़ और वाणी

बंडल किया गया openai Plugin, tts सतह के लिए वाणी संश्लेषण पंजीकृत करता है।उपलब्ध मॉडल: gpt-4o-mini-tts, tts-1, tts-1-hd। उपलब्ध आवाज़ें: alloy, ash, ballad, cedar, coral, echo, fable, juniper, marin, onyx, nova, sage, shimmer, verseextraBody को OpenClaw द्वारा जनरेट किए गए फ़ील्ड के बाद /audio/speech अनुरोध JSON में मर्ज किया जाता है, इसलिए इसका उपयोग उन OpenAI-संगत एंडपॉइंट के लिए करें जिन्हें lang जैसी अतिरिक्त कुंजियों की आवश्यकता होती है। प्रोटोटाइप कुंजियों को अनदेखा किया जाता है।
चैट API एंडपॉइंट को प्रभावित किए बिना TTS बेस URL को ओवरराइड करने के लिए OPENAI_TTS_BASE_URL सेट करें। OpenAI TTS और Realtime आवाज़, दोनों को OpenAI Platform API कुंजी के माध्यम से कॉन्फ़िगर किया जाता है; केवल OAuth वाले इंस्टॉल अब भी Codex-समर्थित चैट मॉडल का उपयोग कर सकते हैं, लेकिन OpenAI लाइव टॉक-बैक का नहीं।
बंडल किया गया openai Plugin, OpenClaw की मीडिया-अंडरस्टैंडिंग ट्रांसक्रिप्शन सतह के माध्यम से बैच वाणी-से-टेक्स्ट पंजीकृत करता है।
  • डिफ़ॉल्ट मॉडल: gpt-4o-transcribe
  • एंडपॉइंट: OpenAI REST /v1/audio/transcriptions
  • इनपुट पथ: मल्टीपार्ट ऑडियो फ़ाइल अपलोड
  • जहाँ भी इनबाउंड ऑडियो ट्रांसक्रिप्शन tools.media.audio को पढ़ता है, वहाँ उपयोग किया जाता है, जिसमें Discord वॉइस-चैनल सेगमेंट और चैनल ऑडियो अटैचमेंट शामिल हैं
इनबाउंड ऑडियो ट्रांसक्रिप्शन के लिए OpenAI को बाध्य करने हेतु:
साझा ऑडियो मीडिया कॉन्फ़िगरेशन या प्रति-कॉल ट्रांसक्रिप्शन अनुरोध द्वारा दिए जाने पर भाषा और प्रॉम्प्ट संकेत OpenAI को अग्रेषित किए जाते हैं।
बंडल किया गया openai Plugin, Voice Call Plugin के लिए Realtime ट्रांसक्रिप्शन पंजीकृत करता है।
G.711 u-law (g711_ulaw / audio/pcmu) ऑडियो के साथ wss://api.openai.com/v1/realtime से WebSocket कनेक्शन का उपयोग करता है। किसी openai API-कुंजी प्रोफ़ाइल के लिए, Gateway WebSocket खोलने से पहले एक अस्थायी Realtime ट्रांसक्रिप्शन क्लाइंट सीक्रेट बनाता है। यह स्ट्रीमिंग प्रदाता Voice Call के Realtime ट्रांसक्रिप्शन पथ के लिए है; Discord वॉइस वर्तमान में छोटे सेगमेंट रिकॉर्ड करता है और इसके बजाय बैच tools.media.audio ट्रांसक्रिप्शन पथ का उपयोग करता है।
बंडल किया गया openai Plugin, Voice Call Plugin के लिए Realtime आवाज़ पंजीकृत करता है।gpt-realtime-2.1 के लिए उपलब्ध अंतर्निहित Realtime वॉइस: alloy, ash, ballad, coral, echo, sage, shimmer, verse, marin, cedar। सर्वोत्तम Realtime गुणवत्ता के लिए OpenAI marin और cedar की अनुशंसा करता है। यह ऊपर दी गई टेक्स्ट-टू-स्पीच वॉइस से अलग सेट है; केवल TTS वाली वॉइस, जैसे fable, nova, या onyx, Realtime सत्रों के लिए मान्य नहीं है। यदि आप छोटे, कम लागत वाले Realtime 2.1 वेरिएंट को प्राथमिकता देते हैं, तो मॉडल को स्पष्ट रूप से gpt-realtime-2.1-mini पर सेट करें।
GPT-Live (आगामी)। OpenAI के फ़ुल-डुप्लेक्स gpt-live-1 और gpt-live-1-mini मॉडल ने जुलाई 2026 में ChatGPT वॉइस मोड का स्थान लिया; डेवलपर API को प्रारंभिक-पहुँच संगठनों के लिए क्रमिक रूप से उपलब्ध कराया जा रहा है। OpenClaw मॉडल परिवार को पहचानता है, लेकिन इसे अभी चलाता नहीं है: GPT-Live सत्र केवल WebRTC पर चलते हैं, अपना टर्न-टेकिंग स्वयं संभालते हैं (VAD नहीं), और एजेंट का कार्य एक हैंडऑफ़ इवेंट प्रोटोकॉल के माध्यम से सौंपते हैं, जिसे OpenClaw के Realtime ट्रांसपोर्ट अभी लागू नहीं करते। gpt-live-* मॉडल को कॉन्फ़िगर करने पर एजेंट पहुँच के बिना ऑडियो से चुपचाप कनेक्ट होने के बजाय WebSocket ब्रिज और Talk ब्राउज़र दोनों सत्रों के लिए मार्गदर्शन सहित बंद अवस्था में विफलता होती है। प्रारंभिक पहुँच के दौरान API पहुँच भी प्रत्येक OpenAI संगठन के अनुसार नियंत्रित होती है। GPT-Live समर्थन उपलब्ध होने तक gpt-realtime-2.1 (डिफ़ॉल्ट) बनाए रखें।
बैकएंड OpenAI Realtime ब्रिज GA Realtime WebSocket सत्र संरचना का उपयोग करते हैं, जो session.temperature स्वीकार नहीं करती। Azure OpenAI डिप्लॉयमेंट azureEndpoint और azureDeployment के माध्यम से उपलब्ध रहते हैं और डिप्लॉयमेंट-संगत सत्र संरचना (temperature सहित) बनाए रखते हैं। द्विदिश टूल कॉलिंग और G.711 u-law ऑडियो का समर्थन करता है।
सत्र बनाते समय Realtime वॉइस चुनी जाती है। OpenAI अधिकांश सत्र फ़ील्ड को बाद में बदलने की अनुमति देता है, लेकिन उस सत्र में मॉडल द्वारा ऑडियो उत्सर्जित करने के बाद वॉइस नहीं बदली जा सकती। OpenClaw वर्तमान में अंतर्निहित Realtime वॉइस आईडी को स्ट्रिंग के रूप में प्रदर्शित करता है।
Control UI Talk, Gateway द्वारा जारी अस्थायी क्लाइंट सीक्रेट और OpenAI Realtime API के साथ सीधे ब्राउज़र WebRTC SDP एक्सचेंज वाले OpenAI ब्राउज़र Realtime सत्रों का उपयोग करता है। Gateway उस क्लाइंट सीक्रेट को चयनित openai क्रेडेंशियल से जारी करता है। कॉन्फ़िगर की गई कुंजियाँ, API-कुंजी प्रोफ़ाइल और OPENAI_API_KEY को प्राथमिकता मिलती है; openai OAuth प्रोफ़ाइल या बाहरी Codex लॉगिन फ़ॉलबैक है। Gateway रिले और Voice Call बैकएंड Realtime WebSocket ब्रिज मूल OpenAI एंडपॉइंट के लिए इसी क्रेडेंशियल क्रम का उपयोग करते हैं। मेंटेनर का लाइव सत्यापन OPENAI_API_KEY=... GEMINI_API_KEY=... node --import tsx scripts/dev/realtime-talk-live-smoke.ts के साथ उपलब्ध है; OpenAI चरण सीक्रेट लॉग किए बिना बैकएंड WebSocket ब्रिज और ब्राउज़र WebRTC SDP एक्सचेंज दोनों को सत्यापित करते हैं। Google क्रेडेंशियल के बिना इन दोनों चरणों को चलाने के लिए --openai-only पास करें।

Azure OpenAI एंडपॉइंट

बंडल किया गया openai प्रदाता बेस URL को ओवरराइड करके इमेज जनरेशन के लिए Azure OpenAI संसाधन को लक्षित कर सकता है। इमेज-जनरेशन पथ पर, OpenClaw models.providers.openai.baseUrl पर Azure होस्टनाम का पता लगाता है और स्वचालित रूप से Azure की अनुरोध संरचना पर स्विच करता है।
Realtime वॉइस एक अलग कॉन्फ़िगरेशन पथ (plugins.entries.voice-call.config.realtime.providers.openai.azureEndpoint) का उपयोग करती है और models.providers.openai.baseUrl से प्रभावित नहीं होती। इसकी Azure सेटिंग के लिए वॉइस और स्पीच के अंतर्गत Realtime वॉइस अकॉर्डियन देखें।
Azure OpenAI का उपयोग तब करें जब:
  • आपके पास पहले से Azure OpenAI सदस्यता, कोटा या एंटरप्राइज़ अनुबंध हो
  • आपको क्षेत्रीय डेटा रेज़िडेंसी या Azure द्वारा प्रदान किए जाने वाले अनुपालन नियंत्रणों की आवश्यकता हो
  • आप ट्रैफ़िक को मौजूदा Azure टेनेंसी के भीतर रखना चाहते हों

कॉन्फ़िगरेशन

बंडल किए गए openai प्रदाता के माध्यम से Azure इमेज जनरेशन के लिए, models.providers.openai.baseUrl को अपने Azure संसाधन पर इंगित करें और apiKey को Azure OpenAI कुंजी पर सेट करें (OpenAI Platform कुंजी पर नहीं):
OpenClaw, Azure इमेज-जनरेशन रूट के लिए इन Azure होस्ट सफ़िक्स को पहचानता है:
  • *.openai.azure.com
  • *.services.ai.azure.com
  • *.cognitiveservices.azure.com
पहचाने गए Azure होस्ट पर इमेज-जनरेशन अनुरोधों के लिए, OpenClaw:
  • Authorization: Bearer के बजाय api-key हेडर भेजता है
  • डिप्लॉयमेंट-स्कोप वाले पथों (/openai/deployments/{deployment}/...) का उपयोग करता है
  • प्रत्येक अनुरोध में ?api-version=... जोड़ता है
  • Azure इमेज-जनरेशन कॉल के लिए 600s की डिफ़ॉल्ट अनुरोध टाइमआउट अवधि का उपयोग करता है। प्रत्येक कॉल के timeoutMs मान फिर भी इस डिफ़ॉल्ट को ओवरराइड करते हैं।
अन्य बेस URL (सार्वजनिक OpenAI, OpenAI-संगत प्रॉक्सी) मानक OpenAI इमेज अनुरोध संरचना बनाए रखते हैं।
openai प्रदाता के इमेज-जनरेशन पथ के लिए Azure रूटिंग हेतु OpenClaw 2026.4.22 या बाद का संस्करण आवश्यक है। पहले के संस्करण किसी भी कस्टम openai.baseUrl को सार्वजनिक OpenAI एंडपॉइंट की तरह मानते हैं और Azure इमेज डिप्लॉयमेंट पर विफल होते हैं।

API संस्करण

Azure इमेज-जनरेशन पथ के लिए किसी विशिष्ट Azure प्रीव्यू या GA संस्करण को पिन करने हेतु AZURE_OPENAI_API_VERSION सेट करें:
वेरिएबल सेट न होने पर डिफ़ॉल्ट 2024-12-01-preview है।

मॉडल नाम ही डिप्लॉयमेंट नाम हैं

Azure OpenAI मॉडल को डिप्लॉयमेंट से बाँधता है। बंडल किए गए openai प्रदाता के माध्यम से रूट किए गए Azure इमेज-जनरेशन अनुरोधों के लिए, OpenClaw में model फ़ील्ड वह Azure डिप्लॉयमेंट नाम होना चाहिए जिसे आपने Azure पोर्टल में कॉन्फ़िगर किया है, न कि सार्वजनिक OpenAI मॉडल आईडी। यदि आप gpt-image-2 प्रदान करने वाला gpt-image-2-prod नामक डिप्लॉयमेंट बनाते हैं:
डिप्लॉयमेंट-नाम का यही नियम बंडल किए गए openai प्रदाता के माध्यम से रूट की गई प्रत्येक इमेज-जनरेशन कॉल पर लागू होता है।

क्षेत्रीय उपलब्धता

Azure इमेज जनरेशन वर्तमान में केवल कुछ क्षेत्रों में उपलब्ध है (उदाहरण के लिए eastus2, swedencentral, polandcentral, westus3, uaenorth)। डिप्लॉयमेंट बनाने से पहले Microsoft की वर्तमान क्षेत्र सूची जाँचें और पुष्टि करें कि विशिष्ट मॉडल आपके क्षेत्र में उपलब्ध है।

पैरामीटर अंतर

Azure OpenAI और सार्वजनिक OpenAI हमेशा समान इमेज पैरामीटर स्वीकार नहीं करते। Azure उन विकल्पों को अस्वीकार कर सकता है जिनकी सार्वजनिक OpenAI अनुमति देता है (उदाहरण के लिए gpt-image-2 पर कुछ background मान), या उन्हें केवल विशिष्ट मॉडल संस्करणों पर उपलब्ध करा सकता है। ये अंतर Azure और अंतर्निहित मॉडल से आते हैं, OpenClaw से नहीं। यदि कोई Azure अनुरोध सत्यापन त्रुटि के साथ विफल होता है, तो Azure पोर्टल में अपने विशिष्ट डिप्लॉयमेंट और API संस्करण द्वारा समर्थित पैरामीटर सेट जाँचें।
Azure OpenAI मूल ट्रांसपोर्ट और संगतता व्यवहार का उपयोग करता है, लेकिन उसे OpenClaw के छिपे हुए एट्रिब्यूशन हेडर प्राप्त नहीं होते—उन्नत कॉन्फ़िगरेशन के अंतर्गत मूल बनाम OpenAI-संगत रूट अकॉर्डियन देखें।Azure पर चैट या Responses ट्रैफ़िक (इमेज जनरेशन से परे) के लिए, ऑनबोर्डिंग प्रवाह या समर्पित Azure प्रदाता कॉन्फ़िग का उपयोग करें; केवल openai.baseUrl Azure API/प्रमाणीकरण संरचना को नहीं अपनाता। एक अलग azure-openai-responses/* प्रदाता मौजूद है; नीचे Server-side compaction अकॉर्डियन देखें।

उन्नत कॉन्फ़िगरेशन

नीचे दिए गए प्रति-मॉडल params उदाहरण OpenClaw के एम्बेडेड प्रदाता अनुरोध को आकार देते हैं। इन्हें कॉन्फ़िगर करना स्वयं निर्धारित अनुरोध व्यवहार है, इसलिए अन्यथा पात्र auto रूट Codex को अंतर्निहित रूप से चुनने के बजाय OpenClaw पर ही रहता है। मूल Codex ऐप-सर्वर हार्नेस अपने ट्रांसपोर्ट और अनुरोध सेटिंग का स्वामी है; प्रभावी रूट को Codex-संगत घोषित न किए जाने पर स्पष्ट agentRuntime.id: "codex" बंद अवस्था में विफल होता है।
OpenClaw, openai/* के लिए SSE फ़ॉलबैक ("auto") के साथ WebSocket-प्रथम का उपयोग करता है।"auto" मोड में, OpenClaw:
  • SSE पर फ़ॉलबैक करने से पहले एक शुरुआती WebSocket विफलता पर दोबारा प्रयास करता है
  • विफलता के बाद, WebSocket को 60 सेकंड के लिए अवनत चिह्नित करता है और कूल-डाउन के दौरान SSE का उपयोग करता है
  • पुनः प्रयास और पुनः कनेक्शन के लिए स्थिर सत्र तथा टर्न पहचान हेडर संलग्न करता है
  • ट्रांसपोर्ट वेरिएंट में उपयोग काउंटर (input_tokens / prompt_tokens) को सामान्यीकृत करता है
संबंधित OpenAI दस्तावेज़:
OpenClaw, openai/* के लिए एक साझा तेज़-मोड टॉगल उपलब्ध कराता है:
  • चैट/UI: /fast status|auto|on|off
  • कॉन्फ़िग: agents.defaults.models["<provider>/<model>"].params.fastMode
सक्षम होने पर, OpenClaw तेज़ मोड को OpenAI प्राथमिकता प्रोसेसिंग (service_tier = "priority") से मैप करता है। मौजूदा service_tier मान सुरक्षित रखे जाते हैं, और तेज़ मोड reasoning या text.verbosity को दोबारा नहीं लिखता। fastMode: "auto" स्वतः कटऑफ़ तक नए मॉडल कॉल तेज़ मोड में शुरू करता है, फिर बाद के पुनः प्रयास, फ़ॉलबैक, टूल-परिणाम या निरंतरता कॉल तेज़ मोड के बिना शुरू करता है। कटऑफ़ का डिफ़ॉल्ट 60 सेकंड है; इसे बदलने के लिए सक्रिय मॉडल पर params.fastAutoOnSeconds सेट करें।
सत्र ओवरराइड को कॉन्फ़िग पर प्राथमिकता मिलती है। Sessions UI में सत्र ओवरराइड साफ़ करने पर सत्र कॉन्फ़िगर किए गए डिफ़ॉल्ट पर लौट जाता है।
OpenAI का API service_tier के माध्यम से प्राथमिकता प्रोसेसिंग उपलब्ध कराता है। इसे OpenClaw में प्रत्येक मॉडल के लिए सेट करें:
समर्थित मान: auto, default, flex, priority
serviceTier केवल मूल OpenAI एंडपॉइंट (api.openai.com) और मूल Codex एंडपॉइंट (chatgpt.com/backend-api) को अग्रेषित किया जाता है। यदि आप किसी भी प्रदाता को प्रॉक्सी के माध्यम से रूट करते हैं, तो OpenClaw service_tier को अपरिवर्तित छोड़ देता है।
प्रत्यक्ष OpenAI Responses मॉडल (api.openai.com पर openai/*) के लिए, OpenAI Plugin का OpenClaw स्ट्रीम रैपर सर्वर-साइड Compaction को स्वतः सक्षम करता है:
  • store: true को अनिवार्य करता है (जब तक मॉडल संगतता supportsStore: false सेट न करे)
  • context_management: [{ type: "compaction", compact_threshold: ... }] अंतःक्षेपित करता है
  • डिफ़ॉल्ट compact_threshold: contextWindow का 70% (या अनुपलब्ध होने पर 80000)
यह अंतर्निहित OpenClaw रनटाइम पथ और एम्बेडेड रन द्वारा उपयोग किए जाने वाले OpenAI प्रदाता हुक पर लागू होता है। मूल Codex ऐप-सर्वर हार्नेस Codex के माध्यम से अपने कॉन्टेक्स्ट का प्रबंधन करता है और इस सेटिंग से प्रभावित नहीं होता।
Azure OpenAI Responses जैसे संगत एंडपॉइंट के लिए उपयोगी:
responsesServerCompaction केवल context_management के अंतःक्षेपण को नियंत्रित करता है। प्रत्यक्ष OpenAI Responses मॉडल तब भी store: true को अनिवार्य करते हैं, जब तक संगतता supportsStore: false सेट न करे।
OpenClaw के एम्बेडेड रनटाइम के माध्यम से चलने वाले openai प्रदाता के GPT-5-परिवार मॉडल के लिए, OpenClaw पहले से ही strict-agentic नामक अधिक सख्त निष्पादन अनुबंध को डिफ़ॉल्ट रूप से उपयोग करता है। जब भी समाधान किया गया प्रदाता openai हो और मॉडल आईडी GPT-5 परिवार से मेल खाती हो, यह स्वतः सक्रिय हो जाता है, जब तक कॉन्फ़िगरेशन स्पष्ट रूप से इससे बाहर निकलने का विकल्प न चुने:
"strict-agentic" को स्पष्ट रूप से सेट करने का समर्थित लेन पर कोई प्रभाव नहीं पड़ता (यह पहले से ही डिफ़ॉल्ट है) और असमर्थित प्रदाता/मॉडल युग्मों पर यह निष्क्रिय रहता है।strict-agentic सक्रिय होने पर, OpenClaw:
  • पर्याप्त कार्य के लिए update_plan को स्वतः सक्षम करता है
  • संरचनात्मक रूप से खाली या केवल तर्क वाले टर्न को दृश्यमान-उत्तर निरंतरता के साथ पुनः प्रयास करता है
  • चयनित हार्नेस द्वारा उपलब्ध कराए जाने पर स्पष्ट हार्नेस योजना इवेंट का उपयोग करता है
OpenClaw यह तय करने के लिए सहायक के गद्य को वर्गीकृत नहीं करता कि कोई टर्न योजना, प्रगति अपडेट या अंतिम उत्तर है।
यह अनुबंध पूरी तरह OpenClaw के एम्बेडेड एजेंट रनर में स्थित है। यह मूल Codex ऐप-सर्वर हार्नेस पर लागू नहीं होता, जो अपने टर्न और योजना व्यवहार का स्वयं प्रबंधन करता है; मूल Codex रन के लिए निष्पादन-अनुबंध सेटिंग की तुलना में हार्नेस का चयन अधिक महत्वपूर्ण है।
OpenClaw प्रत्यक्ष OpenAI, Codex और Azure OpenAI एंडपॉइंट को सामान्य OpenAI-संगत /v1 प्रॉक्सी से अलग तरीके से संभालता है:मूल रूट (openai/*, Azure OpenAI):
  • reasoning: { effort: "none" } केवल उन मॉडलों के लिए रखता है जो OpenAI none प्रयास का समर्थन करते हैं
  • उन मॉडलों या प्रॉक्सी के लिए अक्षम तर्क को छोड़ देता है जो reasoning.effort: "none" को अस्वीकार करते हैं
  • टूल स्कीमा को डिफ़ॉल्ट रूप से सख्त मोड में रखता है
  • छिपे हुए एट्रिब्यूशन हेडर केवल सत्यापित मूल होस्ट पर संलग्न करता है (Azure OpenAI को ये हेडर नहीं मिलते, भले ही वह एक मूल रूट हो)
  • केवल-OpenAI अनुरोध आकार-निर्धारण (service_tier, store, तर्क-संगतता, प्रॉम्प्ट-कैश संकेत) बनाए रखता है
प्रॉक्सी/संगत रूट:
  • अधिक शिथिल संगतता व्यवहार का उपयोग करते हैं
  • गैर-मूल openai-completions पेलोड से Completions store हटाते हैं
  • OpenAI-संगत Completions प्रॉक्सी के लिए उन्नत params.extra_body/params.extraBody पास-थ्रू JSON स्वीकार करते हैं
  • vLLM जैसे OpenAI-संगत Completions प्रॉक्सी के लिए params.chat_template_kwargs स्वीकार करते हैं
  • सख्त टूल स्कीमा या केवल-मूल हेडर को अनिवार्य नहीं करते

संबंधित

मॉडल चयन

प्रदाताओं, मॉडल संदर्भों और फ़ेलओवर व्यवहार का चयन।

इमेज जनरेशन

साझा इमेज टूल पैरामीटर और प्रदाता चयन।

वीडियो जनरेशन

साझा वीडियो टूल पैरामीटर और प्रदाता चयन।

OAuth और प्रमाणीकरण

प्रमाणीकरण विवरण और क्रेडेंशियल के पुनः उपयोग के नियम।