परिचय
Scrapeless Scraping API एक अभिनव समाधान है जिसे वेबसाइटों से डेटा के एक्सट्रैक्शन को सरल बनाने के लिए डिज़ाइन किया गया है। यहाँ तक कि सबसे जटिल वेब वातावरणों को नेविगेट करने के लिए इंजीनियर किया गया, यह डायनामिक सामग्री और JavaScript रेंडरिंग को प्रभावी रूप से प्रबंधित करता है।
एक ही API कॉल से आपको स्वच्छ, संरचित डेटा तक तत्काल पहुँच मिलती है — आपकी ओर से लिखने या बनाए रखने के लिए कोई proxies, browsers या CAPTCHA हैंडलिंग नहीं।
उपलब्ध Scrapers
प्रत्येक scraper एक ही API के माध्यम से उपलब्ध होता है, जिसे actor पैरामीटर से चुना जाता है। नीचे दिए गए किसी scraper से शुरुआत करें:
| स्क्रेपर | actor | विवरण |
|---|---|---|
| Google Search | scraper.google.search | रियल-टाइम Google Search और Google Image परिणाम संरचित JSON के रूप में। |
| Amazon Scraper | scraper.amazon | Amazon से उत्पाद विवरण, कीवर्ड सर्च परिणाम, विक्रेता डेटा और शॉपिंग AI उत्तरों के लिए Rufus/Alexa। |
| TikTok Scraper | scraper.tiktok | TikTok से उपयोगकर्ता प्रोफ़ाइल, उपयोगकर्ता पोस्ट और TikTok Shop उत्पाद विवरण। |
शुरुआत करना
किसी लक्षित साइट से संरचित डेटा एक्सट्रैक्ट करने के लिए एक ही API कॉल भेजें। नीचे दिया गया उदाहरण एक टास्क सबमिट करता है और, लंबे समय तक चलने वाले टास्क के लिए, परिणाम तैयार होने तक पोल करता है।
import { Scrapeless } from '@scrapeless-ai/sdk';
const client = new Scrapeless({
apiKey: 'YOUR_API_KEY',
});
async function runTask() {
const result = await client.scraping.scrape({
actor: 'scraper.shopee',
input: {
url: 'https://shopee.tw/a-i.10228173.24803858474'
}
});
return result;
}
runTask()
.then(data => {
console.log('Data:', data);
})
.catch(error => {
console.error('Error:', error);
});पैरामीटर
| पैरामीटर | प्रकार | विवरण |
|---|---|---|
| actor | string | Scraping सेवा (उदा., scraper.shopee)। |
| input | object | टास्क-विशिष्ट पैरामीटर (उदा., action, url)। |
| proxy | object | country फ़ील्ड के साथ वैकल्पिक proxy कॉन्फ़िगरेशन। |
टास्क वर्कफ़्लो
प्रत्येक Scraping API टास्क समान तीन-चरणीय जीवनचक्र का अनुसरण करता है। तेज़ टास्क डेटा को सीधे लौटाते हैं; लंबे समय तक चलने वाले टास्क एक असिंक्रोनस, परिणाम-के-लिए-पोल फ्लो में स्विच हो जाते हैं।
- एक कार्य सबमिट करें —
POSTअनुरोध को/api/v1/scraper/requestपर भेजें। - प्रतिक्रिया को संभालें
- HTTP 200 (सफलता): डेटा सीधे प्रतिक्रिया बॉडी में लौटाया जाता है।
- HTTP 201 (प्रोसेसिंग): परिणामों के लिए पोल करने हेतु प्रदान किए गए
taskIdका उपयोग करें।
- परिणामों के लिए पोल करें — असिंक्रोनस टास्क के लिए, डेटा तैयार होने तक (HTTP 200) बार-बार
/api/v1/scraper/result/{taskId}को कॉल करें।
स्थिति कोड की पूर्ण सूची और पोलिंग मार्गदर्शन के लिए, देखें परिणाम और पोलिंग। पोलिंग के बजाय कॉलबैक के माध्यम से परिणाम प्राप्त करने के लिए, देखें वेबहुक्स।
बिलिंग जानकारी
- शुल्क प्रति-अनुरोध आधार पर लागू किए जाते हैं।
- केवल सफल अनुरोधों का ही बिल बनेगा।