दस्तावेज़Scraping APIपरिचय

परिचय

Scrapeless Scraping API एक अभिनव समाधान है जिसे वेबसाइटों से डेटा के एक्सट्रैक्शन को सरल बनाने के लिए डिज़ाइन किया गया है। यहाँ तक कि सबसे जटिल वेब वातावरणों को नेविगेट करने के लिए इंजीनियर किया गया, यह डायनामिक सामग्री और JavaScript रेंडरिंग को प्रभावी रूप से प्रबंधित करता है।

एक ही API कॉल से आपको स्वच्छ, संरचित डेटा तक तत्काल पहुँच मिलती है — आपकी ओर से लिखने या बनाए रखने के लिए कोई proxies, browsers या CAPTCHA हैंडलिंग नहीं।

उपलब्ध Scrapers

प्रत्येक scraper एक ही API के माध्यम से उपलब्ध होता है, जिसे actor पैरामीटर से चुना जाता है। नीचे दिए गए किसी scraper से शुरुआत करें:

स्क्रेपरactorविवरण
Google Searchscraper.google.searchरियल-टाइम Google Search और Google Image परिणाम संरचित JSON के रूप में।
Amazon Scraperscraper.amazonAmazon से उत्पाद विवरण, कीवर्ड सर्च परिणाम, विक्रेता डेटा और शॉपिंग AI उत्तरों के लिए Rufus/Alexa।
TikTok Scraperscraper.tiktokTikTok से उपयोगकर्ता प्रोफ़ाइल, उपयोगकर्ता पोस्ट और TikTok Shop उत्पाद विवरण।

शुरुआत करना

किसी लक्षित साइट से संरचित डेटा एक्सट्रैक्ट करने के लिए एक ही API कॉल भेजें। नीचे दिया गया उदाहरण एक टास्क सबमिट करता है और, लंबे समय तक चलने वाले टास्क के लिए, परिणाम तैयार होने तक पोल करता है।

import { Scrapeless } from '@scrapeless-ai/sdk';
const client = new Scrapeless({
  apiKey: 'YOUR_API_KEY',
});
 
async function runTask() {
  const result = await client.scraping.scrape({
    actor: 'scraper.shopee',
    input: {
      url: 'https://shopee.tw/a-i.10228173.24803858474'
    }
  });
 
  return result;
}
 
runTask()
  .then(data => {
    console.log('Data:', data);
  })
  .catch(error => {
    console.error('Error:', error);
  });

पैरामीटर

पैरामीटरप्रकारविवरण
actorstringScraping सेवा (उदा., scraper.shopee)।
inputobjectटास्क-विशिष्ट पैरामीटर (उदा., action, url)।
proxyobjectcountry फ़ील्ड के साथ वैकल्पिक proxy कॉन्फ़िगरेशन।

टास्क वर्कफ़्लो

प्रत्येक Scraping API टास्क समान तीन-चरणीय जीवनचक्र का अनुसरण करता है। तेज़ टास्क डेटा को सीधे लौटाते हैं; लंबे समय तक चलने वाले टास्क एक असिंक्रोनस, परिणाम-के-लिए-पोल फ्लो में स्विच हो जाते हैं।

  1. एक कार्य सबमिट करें — POST अनुरोध को /api/v1/scraper/request पर भेजें।
  2. प्रतिक्रिया को संभालें
    1. HTTP 200 (सफलता): डेटा सीधे प्रतिक्रिया बॉडी में लौटाया जाता है।
    2. HTTP 201 (प्रोसेसिंग): परिणामों के लिए पोल करने हेतु प्रदान किए गए taskId का उपयोग करें।
  3. परिणामों के लिए पोल करें — असिंक्रोनस टास्क के लिए, डेटा तैयार होने तक (HTTP 200) बार-बार /api/v1/scraper/result/{taskId} को कॉल करें।

स्थिति कोड की पूर्ण सूची और पोलिंग मार्गदर्शन के लिए, देखें परिणाम और पोलिंग। पोलिंग के बजाय कॉलबैक के माध्यम से परिणाम प्राप्त करने के लिए, देखें वेबहुक्स।

बिलिंग जानकारी

  1. शुल्क प्रति-अनुरोध आधार पर लागू किए जाते हैं।
  2. केवल सफल अनुरोधों का ही बिल बनेगा।