Amazon Scraper एंडपॉइंट्स
इस पृष्ठ पर प्रत्येक क्रिया के लिए एक्टर का उपयोग करें scraper.amazon । input.type के साथ क्रिया का चयन करें और इसके संबंधित इनपुट प्रदान करें।
अनुरोध और प्रमाणीकरण
POST https://api.scrapeless.com/api/v1/scraper/request
x-api-token: YOUR_API_KEY
Content-Type: application/jsonअपनी Scrapeless API कुंजी के साथ YOUR_API_KEY को प्रतिस्थापित करें। actor और input युक्त एक JSON ऑब्जेक्ट भेजें।
एक ऑपरेशन चुनें
| ऑपरेशन | input.type | नीचे उपयोग किए गए इनपुट |
|---|---|---|
| उत्पाद | product | url, zip_code |
| विक्रेता | seller | url, zip_code |
| कीवर्ड खोज | keywords | keywords, page, domain, zip_code |
| रुफस | rufus | keywords, domain |
उत्पाद
एक एमेज़ॅन उत्पाद URL प्रदान करें। उत्पाद स्कीमा की आवश्यकता होती है url; zip_code वितरण-स्थान की जानकारी प्रदान करता है।
curl --request POST 'https://api.scrapeless.com/api/v1/scraper/request' \
--header 'x-api-token: YOUR_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"actor": "scraper.amazon",
"input": {
"type": "product",
"url": "https://www.amazon.com/dp/B0BQXHK363",
"zip_code": ""
}
}'प्रकाशित प्रतिक्रिया में शामिल हैं asin, title, availability, final_price, rating, reviews_count, images, और variations। एक संक्षिप्त प्रतिक्रिया उदाहरण के लिए देखें त्वरित शुरुआत ।
विक्रेता
विक्रेता पृष्ठ का URL प्रदान करें। शामिल करें zip_code: विक्रेता स्कीमा इसे आवश्यक के रूप में चिह्नित करता है, और इसके अनुरोध उदाहरण में एक खाली स्ट्रिंग का उपयोग किया गया है।
curl --request POST 'https://api.scrapeless.com/api/v1/scraper/request' \
--header 'x-api-token: YOUR_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"actor": "scraper.amazon",
"input": {
"type": "seller",
"url": "https://www.amazon.com/sp?seller=A2XZ7JICGUQ1CX",
"zip_code": ""
}
}'विक्रेता संदर्भ सफल प्रतिक्रिया को एक फ़ील्ड-स्तरीय स्कीमा या उदाहरण के बिना JSON ऑब्जेक्ट के रूप में परिभाषित करता है। अपने अनुप्रयोग में विक्रेता फ़ील्ड्स को मैप करने से पहले लौटे गए पेलोड का निरीक्षण करें।
कीवर्ड खोज
keywordsमें खोज पाठ प्रदान करें। खोज परिणाम पृष्ठ का चयन करने के लिए page का उपयोग करें। नीचे दिया गया उदाहरण दस्तावेज़ीकृत संख्यात्मक पृष्ठ मान का अनुसरण करता है और Amazon.com के लिए domain: "com" का उपयोग करता है; यह वैकल्पिक विभाग फ़िल्टर को छोड़ देता है।
curl --request POST 'https://api.scrapeless.com/api/v1/scraper/request' \
--header 'x-api-token: YOUR_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"actor": "scraper.amazon",
"input": {
"type": "keywords",
"keywords": "Iphone+14+Pro+512GB",
"page": 1,
"domain": "com",
"zip_code": ""
}
}'| इनपुट | उपयोग करें |
|---|---|
keywords | खोज कीवर्ड; ऑपरेशन स्कीमा द्वारा आवश्यक। |
page | खोज परिणाम पृष्ठ संख्या। |
domain | एमेज़ॅन डोमेन सेटिंग; आधिकारिक उदाहरण com का उपयोग करता है। |
department | वैकल्पिक विभाग उपनाम, जो एमेज़ॅन के i क्वेरी पैरामीटर के अनुरूप है। |
zip_code | वितरण जानकारी के लिए डाक कोड। |
प्रकाशित प्रतिक्रिया में keyword, page, result, total_results_count, और url है। उत्पाद प्रविष्टियाँ result.organic के अंतर्गत दिखाई देती हैं। अनुरोध उदाहरण से भिन्न क्वेरी और पृष्ठ के लिए प्रतिक्रिया उदाहरण है, इसलिए इसका उपयोग फ़ील्ड्स को समझने के लिए किया जाना चाहिए न कि सटीक परिणामों की भविष्यवाणी करने के लिए।
एमेज़ॅन पैरामीटर गाइड पूर्णांक page मान निर्दिष्ट करती है, और अनुरोध उदाहरण 1 का उपयोग करता है; उत्पन्न ऑपरेशन स्कीमा वर्तमान में page को एक स्ट्रिंग के रूप में लेबल करता है। यह गाइड पैरामीटर गाइड और अनुरोध उदाहरण का अनुसरण करती है।
रुफस
type को rufus पर सेट करें। दोनों keywords और domain ऑपरेशन स्कीमा द्वारा आवश्यक हैं। एक पूर्ण एमेज़ॅन डोमेन, जैसे www.amazon.es का उपयोग करें, जो कीवर्ड खोज उदाहरण में उपयोग किए गए com प्रारूप के बजाय है।
curl --request POST 'https://api.scrapeless.com/api/v1/scraper/request' \
--header 'x-api-token: YOUR_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"actor": "scraper.amazon",
"input": {
"type": "rufus",
"keywords": "macbook",
"domain": "www.amazon.es"
}
}'प्रकाशित प्रतिक्रिया में शामिल है:
| फ़ील्ड | API उदाहरण में दिखाया गया सामग्री |
|---|---|
html | घटना रिकॉर्ड और HTML अंश युक्त कच्ची सामग्री। |
metadata | में शामिल हैं type और rawUrl। |
result.user_query | क्वेरी पाठ। |
result.products | क्वेरी के लिए लौटाए गए उत्पाद प्रविष्टि। |
result.related_questions | संबंधित प्रश्न। |
ऑपरेशन स्कीमा में is_sse_data, is_get_question, और asin का भी उल्लेख है, लेकिन उनके व्यवहार की व्याख्या नहीं की गई है। ऊपर दिए गए दस्तावेजीकृत अनुरोध से शुरुआत करें।
टास्क परिणामों को संभालें
एक HTTP 200 प्रतिक्रिया पूर्ण परिणाम शामिल होती है। एक HTTP 201 प्रतिक्रिया का अर्थ है कि प्रसंस्करण अभी भी चल रहा है; इसके taskId को सहेजें और निम्नलिखित के साथ उस टास्क को पुनः प्राप्त करें:
curl --request GET 'https://api.scrapeless.com/api/v1/scraper/result/YOUR_TASK_ID' \
--header 'x-api-token: YOUR_API_KEY'अपने अनुरोध द्वारा लौटाई गई ID से YOUR_TASK_ID को बदलें। पोलिंग अंतराल और पुनः प्रयास सीमाओं के लिए परिणाम और पोलिंग का अनुसरण करें।
HTTP स्थिति कोड के साथ-साथ त्रुटि बॉडी का भी निरीक्षण करें। एक 400 प्रतिक्रिया में code: 20500 और message: "scraping failed" शामिल हो सकते हैं; यह एक सफल डेटा प्रतिक्रिया नहीं है। पुनः प्रयास करने से पहले लक्ष्य और अनुरोध इनपुट की जाँच करें।
पैरामीटर संदर्भ
विभाग उपनामों और अन्य दस्तावेजीकृत इनपुट के लिए Amazon API पैरामीटर का उपयोग करें। चयनित type के लिए परिणामों को पार्स करें; उत्पाद, कीवर्ड खोज, विक्रेता और रूफस एकल फ़ील्ड लेआउट को साझा नहीं करते हैं।