DocumentaçãoScraping APIIntrodução

Introdução

A Scrapeless Scraping API é uma solução inovadora projetada para simplificar a extração de dados de sites com facilidade. Desenvolvida para navegar até nos ambientes web mais complexos, ela gerencia com eficácia conteúdo dinâmico e renderização de JavaScript.

Com uma única chamada de API você obtém acesso instantâneo a dados limpos e estruturados — sem proxies, navegadores ou tratamento de CAPTCHA para escrever ou manter do seu lado.

Scrapers Disponíveis

Cada scraper é exposto por meio da mesma API, selecionado com o parâmetro actor. Comece com um scraper abaixo:

ScraperactorDescrição
Google Searchscraper.google.searchResultados em tempo real do Google Search e do Google Image como JSON estruturado.
Amazon Scraperscraper.amazonDetalhes de produtos, resultados de busca por palavra-chave, dados de vendedores e Rufus/Alexa para respostas de IA de compras da Amazon.
TikTok Scraperscraper.tiktokPerfis de usuário, posts de usuário e detalhes de produtos do TikTok Shop da TikTok.

Primeiros Passos

Envie uma única chamada de API para extrair dados estruturados de um site de destino. O exemplo abaixo envia uma tarefa e, para tarefas de execução mais longa, faz polling até que o resultado esteja pronto.

import { Scrapeless } from '@scrapeless-ai/sdk';
const client = new Scrapeless({
  apiKey: 'YOUR_API_KEY',
});
 
async function runTask() {
  const result = await client.scraping.scrape({
    actor: 'scraper.shopee',
    input: {
      url: 'https://shopee.tw/a-i.10228173.24803858474'
    }
  });
 
  return result;
}
 
runTask()
  .then(data => {
    console.log('Data:', data);
  })
  .catch(error => {
    console.error('Error:', error);
  });

Parâmetros

ParâmetroTipoDescrição
actorstringServiço de scraping (por exemplo, scraper.shopee).
inputobjectParâmetros específicos da tarefa (por exemplo, action, url).
proxyobjectConfiguração opcional de proxy com o campo country.

Fluxo de Trabalho da Tarefa

Toda tarefa da Scraping API segue o mesmo ciclo de vida de três etapas. Tarefas rápidas retornam os dados diretamente; tarefas de execução mais longa passam para um fluxo assíncrono de polling por resultados.

  1. Enviar uma Tarefa — Envie uma requisição POST para /api/v1/scraper/request.
  2. Tratar a Resposta
    1. HTTP 200 (Sucesso): Os dados são retornados diretamente no corpo da resposta.
    2. HTTP 201 (Processando): Use o taskId fornecido para fazer polling por resultados.
  3. Fazer Polling por Resultados — Para tarefas assíncronas, chame repetidamente /api/v1/scraper/result/{taskId} até que os dados estejam prontos (HTTP 200).

Para a lista completa de códigos de status e orientações sobre polling, consulte Resultados e Polling. Para receber resultados por meio de um callback em vez de polling, consulte Webhooks.

Informações de Cobrança

  1. As cobranças são aplicadas por requisição.
  2. Apenas requisições bem-sucedidas serão cobradas.