Skip to main content
OpenClaw Firecrawl का तीन तरीकों से उपयोग कर सकता है:
  • web_search प्रदाता के रूप में
  • स्पष्ट Plugin टूल के रूप में: firecrawl_search और firecrawl_scrape
  • web_fetch के लिए फ़ॉलबैक एक्सट्रैक्टर के रूप में
यह एक होस्टेड एक्सट्रैक्शन/खोज सेवा है जो बॉट से बचाव और कैशिंग का समर्थन करती है, जिससे JS-प्रधान साइटों या सामान्य HTTP फ़ेच को अवरुद्ध करने वाले पेजों पर सहायता मिलती है।

Plugin इंस्टॉल करें

आधिकारिक Plugin इंस्टॉल करें, फिर Gateway पुनः आरंभ करें:

बिना कुंजी की पहुँच और API कुंजियाँ

Firecrawl दो web_search प्रदाताओं को पंजीकृत करता है:
  • Firecrawl खोज (firecrawl) — आपकी कुंजी के साथ होस्टेड /v2/search API का उपयोग करता है; कुंजी मौजूद होने पर इसका स्वतः पता लगाया जाता है।
  • Firecrawl खोज (निःशुल्क) (firecrawl-free) — होस्टेड बिना-कुंजी वाले स्टार्टर टियर का उपयोग करता है, API कुंजी आवश्यक नहीं है। यह केवल स्पष्ट सहमति से उपलब्ध है और कभी स्वतः चयनित नहीं होता, क्योंकि इसे चुनने पर आपकी खोज क्वेरी Firecrawl के निःशुल्क टियर को भेजी जाती हैं।
स्पष्ट रूप से चयनित Firecrawl web_fetch फ़ॉलबैक भी बिना कुंजी के काम करता है। स्पष्ट firecrawl_search और firecrawl_scrape टूल के लिए API कुंजी आवश्यक है। अधिक सीमाओं के लिए gateway परिवेश में FIRECRAWL_API_KEY जोड़ें या इसे कॉन्फ़िगर करें।

Firecrawl खोज कॉन्फ़िगर करें

टिप्पणियाँ:
  • ऑनबोर्डिंग या openclaw configure --section web में Firecrawl चुनने से इंस्टॉल किया गया Firecrawl Plugin स्वतः सक्षम हो जाता है।
  • API कुंजी के बिना चलाने के लिए ऑनबोर्डिंग में Firecrawl खोज (निःशुल्क) चुनें (या provider: "firecrawl-free" सेट करें)। कुंजी वाला Firecrawl खोज प्रदाता plugins.entries.firecrawl.config.webSearch.apiKey या FIRECRAWL_API_KEY भेजता है।
  • Firecrawl के साथ web_search, query और count का समर्थन करता है।
  • sources, categories या परिणाम स्क्रैपिंग जैसे Firecrawl-विशिष्ट नियंत्रणों के लिए firecrawl_search का उपयोग करें।
  • baseUrl का डिफ़ॉल्ट होस्टेड Firecrawl https://api.firecrawl.dev है। स्वयं-होस्टेड ओवरराइड की अनुमति केवल निजी/आंतरिक एंडपॉइंट के लिए है; HTTP केवल उन्हीं निजी लक्ष्यों के लिए स्वीकार किया जाता है।
  • FIRECRAWL_BASE_URL, Firecrawl खोज और स्क्रैप के बेस URL के लिए साझा परिवेश फ़ॉलबैक है।
  • Firecrawl खोज अनुरोधों का डिफ़ॉल्ट टाइमआउट 30 सेकंड है; firecrawl_search का timeoutSeconds पैरामीटर प्रत्येक कॉल के लिए इसे ओवरराइड करता है।

Firecrawl web_fetch फ़ॉलबैक कॉन्फ़िगर करें

टिप्पणियाँ:
  • स्पष्ट रूप से चयनित Firecrawl web_fetch फ़ॉलबैक API कुंजी के बिना काम करता है। कॉन्फ़िगर होने पर OpenClaw अधिक सीमाओं के लिए plugins.entries.firecrawl.config.webFetch.apiKey या FIRECRAWL_API_KEY भेजता है।
  • ऑनबोर्डिंग या openclaw configure --section web के दौरान Firecrawl चुनने से Plugin सक्षम होता है और web_fetch के लिए Firecrawl चयनित होता है, बशर्ते कोई अन्य फ़ेच प्रदाता पहले से कॉन्फ़िगर न हो।
  • firecrawl_scrape के लिए API कुंजी आवश्यक है।
  • maxAgeMs नियंत्रित करता है कि कैश किए गए परिणाम कितने पुराने हो सकते हैं (ms)। डिफ़ॉल्ट 172,800,000 ms (2 दिन) है।
  • onlyMainContent का डिफ़ॉल्ट true है; timeoutSeconds का डिफ़ॉल्ट 60 है।
  • पुराना tools.web.fetch.firecrawl.* और tools.web.search.firecrawl.* कॉन्फ़िगरेशन openclaw doctor --fix द्वारा स्वतः माइग्रेट किया जाता है।
  • Firecrawl स्क्रैप/बेस URL ओवरराइड खोज के समान होस्टेड/निजी नियम का पालन करते हैं: सार्वजनिक होस्टेड ट्रैफ़िक https://api.firecrawl.dev का उपयोग करता है; स्वयं-होस्टेड ओवरराइड को निजी/आंतरिक एंडपॉइंट पर रिज़ॉल्व होना चाहिए।
  • firecrawl_scrape, स्पष्ट Firecrawl स्क्रैप कॉल के लिए web_fetch लक्ष्य-सुरक्षा अनुबंध के अनुरूप, स्पष्ट रूप से निजी, लूपबैक, मेटाडेटा और गैर-HTTP(S) लक्ष्य URL को Firecrawl पर अग्रेषित करने से पहले अस्वीकार करता है।
firecrawl_scrape आवश्यक API कुंजी सहित समान plugins.entries.firecrawl.config.webFetch.* सेटिंग और परिवेश चर का पुनः उपयोग करता है।

स्वयं-होस्टेड Firecrawl

Firecrawl को स्वयं चलाते समय plugins.entries.firecrawl.config.webSearch.baseUrl, plugins.entries.firecrawl.config.webFetch.baseUrl या FIRECRAWL_BASE_URL सेट करें। OpenClaw केवल लूपबैक, निजी नेटवर्क, .local, .internal या .localhost लक्ष्यों के लिए http:// स्वीकार करता है। सार्वजनिक कस्टम होस्ट अस्वीकार किए जाते हैं, ताकि Firecrawl API कुंजियाँ गलती से मनमाने एंडपॉइंट को न भेजी जाएँ।

Firecrawl Plugin टूल

सामान्य web_search के बजाय Firecrawl-विशिष्ट खोज नियंत्रणों की आवश्यकता होने पर इसका उपयोग करें। API कुंजी आवश्यक है। पैरामीटर:
  • query
  • count (1-100)
  • sources
  • categories
  • includeDomains / excludeDomains (केवल होस्टनाम; परस्पर अपवर्जित)
  • tbs (समय फ़िल्टर, उदाहरण के लिए qdr:d, qdr:w, sbd:1)
  • location और country (भौगोलिक लक्ष्यीकरण)
  • scrapeResults
  • timeoutSeconds

firecrawl_scrape

JS-प्रधान या बॉट-संरक्षित पेजों के लिए इसका उपयोग करें, जहाँ सामान्य web_fetch कम प्रभावी है। पैरामीटर:
  • url
  • extractMode
  • maxChars
  • onlyMainContent
  • maxAgeMs
  • proxy
  • storeInCache
  • timeoutSeconds

स्टेल्थ / बॉट से बचाव

firecrawl_scrape और web_fetch Firecrawl फ़ॉलबैक का डिफ़ॉल्ट proxy: "auto" तथा storeInCache: true है, जब तक कॉलर उन पैरामीटर को ओवरराइड नहीं करता। firecrawl_search और web_search Firecrawl प्रदाता में proxy/storeInCache नियंत्रण नहीं हैं; स्टेल्थ प्रॉक्सी मोड केवल स्क्रैप/फ़ेच अनुरोधों पर लागू होता है। Firecrawl का proxy मोड बॉट से बचाव को नियंत्रित करता है (basic, stealth या auto)। यदि मूल प्रयास विफल हो जाता है, तो auto स्टेल्थ प्रॉक्सी के साथ पुनः प्रयास करता है, जिसमें केवल मूल स्क्रैपिंग की तुलना में अधिक क्रेडिट लग सकते हैं।

web_fetch Firecrawl का उपयोग कैसे करता है

web_fetch एक्सट्रैक्शन क्रम:
  1. Readability (स्थानीय)
  2. कॉन्फ़िगर किया गया फ़ेच प्रदाता, जैसे Firecrawl (चयनित होने पर या कॉन्फ़िगर किए गए क्रेडेंशियल से स्वतः पता लगने पर)
  3. मूल HTML सफ़ाई (अंतिम फ़ॉलबैक)
चयन नियंत्रण tools.web.fetch.provider है। यदि इसे छोड़ दिया जाता है, तो OpenClaw उपलब्ध क्रेडेंशियल से पहले तैयार वेब-फ़ेच प्रदाता का स्वतः पता लगाता है। आधिकारिक Firecrawl Plugin वह फ़ॉलबैक प्रदान करता है।

संबंधित