त्वरित शुरुआत: अपना पहला Scrapeless अनुरोध बनाएं
Web Unlocker के साथ पृष्ठ पुनर्प्राप्त करके अपना पहला Scrapeless अनुरोध बनाएं। यह उदाहरण cURL का उपयोग करता है और परिणाम को उसी HTTP प्रतिक्रिया में लौटाता है, ताकि आप SDK स्थापित किए बिना या कार्य की पोलिंग किए बिना शुरुआत कर सकें।
शुरू करने से पहले
आपको Web Unlocker तक पहुंच के साथ एक Scrapeless खाते की आवश्यकता है, अनुरोध के लिए पर्याप्त उपलब्ध शेष राशि और स्थानीय टर्मिनल में cURL की आवश्यकता है। नीचे दिए गए कमांड macOS या Linux पर Bash या Zsh का उपयोग करते हैं।
क्या आप ब्राउज़र स्वचालन, एआई उत्तर या खोज परिणामों की तलाश कर रहे हैं? आप सीधे सही उत्पाद चुनें पर जा सकते हैं।
1. अपनी API कुंजी प्राप्त करें
Scrapeless डैशबोर्ड में साइन इन करें, API कुंजी सेटिंग्स खोलें और अपनी कुंजी कॉपी करें। भंडारण और सुरक्षा मार्गदर्शिका के लिए, अपनी API कुंजी प्राप्त करें और सुरक्षित रखें देखें।
अपने टर्मिनल में, निम्नलिखित कमांड चलाएं। कुंजी को छिपे हुए प्रॉम्प्ट पर पेस्ट करें, फिर एंटर दबाएं:
printf 'Scrapeless API key: '
read -rs SCRAPELESS_API_KEY
printf '\n'
export SCRAPELESS_API_KEYयह चर इस टर्मिनल से लॉन्च किए गए कमांड के लिए उपलब्ध है। एक नए टर्मिनल सत्र में इस चरण को दोहराएं।
2. अनुरोध भेजें
कॉपी करें और चलाएं:
curl --silent --show-error \
--request POST 'https://api.scrapeless.com/api/v2/unlocker/request' \
--header "x-api-token: ${SCRAPELESS_API_KEY:?Set SCRAPELESS_API_KEY first}" \
--header 'Content-Type: application/json' \
--data '{
"actor": "unlocker.webunlocker",
"input": {
"url": "https://example.com/",
"method": "GET",
"redirect": false
},
"proxy": {
"country": "ANY"
}
}' \
--output scrapeless-response.json \
--write-out 'HTTP status: %{http_code}\n'यह प्रतिक्रिया बॉडी को scrapeless-response.json में सहेजता है और HTTP स्थिति प्रिंट करता है। यह कमांड API रीडायरेक्ट का अनुसरण नहीं करता या स्वचालित रूप से अनुरोध को दोहराता नहीं है।
| फ़ील्ड | यह क्या करता है |
|---|---|
x-api-token आपकी Scrapeless API कुंजी के साथ अनुरोध का प्रमाणीकरण करता है। | |
actor इसकी API पहचानकर्ता, | का उपयोग करके Web Unlocker का चयन करता है। unlocker.webunlocker |
input.url पुनर्प्राप्त करने के लिए पृष्ठ सेट करता है। | |
input.method लक्ष्य पृष्ठ के लिए उपयोग की जाने वाली विधि सेट करता है। Scrapeless को स्वयं अनुरोध के लिए | का उपयोग होता है। POST |
input.redirect लक्ष्य पृष्ठ से पुनर्निर्देशन का अनुसरण करने के बारे में नियंत्रण करता है। | |
proxy.country जब आपको किसी विशिष्ट प्रॉक्सी देश की आवश्यकता नहीं होती है, तो | का उपयोग करता है। ANY |
एंडपॉइंट अनुबंध के लिए Web Unlocker API संदर्भ देखें।
3. परिणाम का निरीक्षण करें
cat scrapeless-response.jsonसफल प्रतिक्रिया में code और data के साथ एक JSON एन्वलप उपयोग किया जाता है। निम्नलिखित एक संक्षिप्त उदाहरण है, रिकॉर्ड की गई प्रतिक्रिया नहीं है:
{
"code": 200,
"data": "<!doctype html><html>...Example Domain...</html>"
}इस उदाहरण के लिए, जांचें कि HTTP स्थिति 200 है, प्रतिक्रिया code 200 है, और data अनुरोधित पृष्ठ सामग्री को शामिल करता है। केवल एक सहेजी गई फ़ाइल यह स्थापित नहीं करती कि अनुरोध सफल रहा।
जब आप लौटी गई सामग्री में उदाहरण डोमेन पृष्ठ की पहचान कर सकते हैं, तो आपका पहला अनुरोध पूरा हो जाता है।
4. अपने स्वयं के URL का उपयोग करें
input.url को उस पृष्ठ से बदलें जिसे आप पुनः प्राप्त करना चाहते हैं और अनुरोध फिर से भेजें। यदि लक्ष्य पुनर्निर्देशित करता है, तो आवश्यकतानुसार input.redirect को true पर सेट करें।
उपरोक्त उदाहरण जावास्क्रिप्ट रेंडरिंग सक्षम नहीं करता है। स्क्रिप्ट द्वारा लोड की गई सामग्री के लिए, जावास्क्रिप्ट रेंडरिंग गाइड का पालन करें। प्रबंधित वेबसाइट क्रॉल या इंटरैक्टिव ब्राउज़र सत्र के लिए, प्रासंगिक उत्पाद गाइड का उपयोग करें।
यदि अनुरोध विफल हो जाता है
| लक्षण | क्या जाँचें |
|---|---|
शेल आपसे SCRAPELESS_API_KEY सेट करने के लिए कहता है | उसी टर्मिनल में चरण 1 चलाएं। |
| प्रमाणीकरण त्रुटि | जांचें कि कुंजी वर्तमान और पूर्ण है। इसका मूल मान x-api-token में भेजें, Bearer उपसर्ग के बिना। |
| पहुंच या शेष त्रुटि डैशबोर्ड में Web Unlocker एक्सेस और उपलब्ध शेष राशि की जांच करें। | |
| अमान्य अनुरोध त्रुटि | JSON और actor पहचानकर्ता की तुलना उदाहरण से करें। अस्वीकृत क्षेत्र के लिए प्रतिक्रिया निकाय पढ़ें। |
| एक सफल प्रतिक्रिया में अपेक्षित सामग्री लापता है | लक्ष्य URL, पुनर्निर्देशन और यह जांचें कि क्या जावास्क्रिप्ट रेंडरिंग आवश्यक है। |
| नेटवर्क त्रुटि या समय समाप्ति | पुनः प्रयास करने से पहले कनेक्टिविटी और लक्ष्य URL की जांच करें। बिना बदले विफल होने वाले अनुरोध को बार-बार पुनः सबमिट करने से बचें। |
सहायता मांगते समय, एंडपॉइंट, समय, HTTP स्थिति और लाल की गई त्रुटि प्रतिक्रिया साझा करें। अपनी API कुंजी और संवेदनशील लक्ष्य डेटा को हटा दें।
अगले कदम
अपने कार्यप्रवाह के अनुरूप उत्पाद और इंटरफ़ेस चुनें:
- अपने वास्तविक कार्यप्रवाह के लिए सही उत्पाद चुनें ।
- तैनात किए गए अनुप्रयोग को जोड़ने से पहले अपनी API कुंजी की रक्षा करें ।
- Web Unlocker गाइड के साथ जारी रखें।
- स्रोत-विशिष्ट डेटा के लिए Google Search API, Amazon Scraper, या TikTok Scraper का उपयोग करें।
- क्या आप टर्मिनल वर्कफ़्लो पसंद करते हैं? Scrapeless CLI जल्द आ रहा है। इसके गाइड में स्थापना, कॉन्फ़िगरेशन और कमांड्स शामिल होंगे।
- क्या आप एक SDK पसंद करते हैं? Node.js के साथ शुरुआत करें। Python और Go SDK जल्द आ रहे हैं।
जब आप प्रयोग करना समाप्त कर लें, तो इस टर्मिनल वातावरण से कुंजी हटा दें:
unset SCRAPELESS_API_KEYयह स्थानीय चर को साफ़ कर देता है; यह कुंजी को निरस्त नहीं करता।