DocumentaciónScraping APIIntroducción

Introducción

La Scrapeless Scraping API es una solución innovadora diseñada para simplificar la extracción de datos de sitios web con facilidad. Diseñada para navegar incluso en entornos web muy complejos, gestiona eficazmente contenido dinámico y renderizado con JavaScript.

Con una sola llamada a la API obtiene acceso inmediato a datos limpios y estructurados — sin necesidad de escribir o mantener proxies, navegadores o soluciones para CAPTCHA en su lado.

Scrapers disponibles

Cada scraper se expone a través de la misma API, seleccionado con el parámetro actor . Comience con un scraper a continuación:

ScraperactorDescripción
Google Searchscraper.google.searchResultados en tiempo real de Google Search y Google Imágenes como JSON estructurado.
Amazon Scraperscraper.amazonDetalles de productos, resultados de búsqueda por palabra clave, datos de vendedores y respuestas de IA de compras de Rufus/Alexa desde Amazon.
TikTok Scraperscraper.tiktokPerfiles de usuario, publicaciones de usuario y detalles de productos de TikTok Shop desde TikTok.

Inicio rápido

Envíe una única llamada a la API para extraer datos estructurados de un sitio objetivo. El ejemplo de abajo envía una tarea y, para tareas de mayor duración, realiza sondeos hasta que el resultado esté listo.

import { Scrapeless } from '@scrapeless-ai/sdk';
const client = new Scrapeless({
  apiKey: 'YOUR_API_KEY',
});
 
async function runTask() {
  const result = await client.scraping.scrape({
    actor: 'scraper.shopee',
    input: {
      url: 'https://shopee.tw/a-i.10228173.24803858474'
    }
  });
 
  return result;
}
 
runTask()
  .then(data => {
    console.log('Data:', data);
  })
  .catch(error => {
    console.error('Error:', error);
  });

Parámetros

ParámetroTipoDescripción
actorstringServicio de extracción (por ejemplo, scraper.shopee).
inputobjectParámetros específicos de la tarea (por ejemplo, acción, url).
proxyobjectConfiguración opcional de proxy con campo de país.

Flujo de trabajo de la tarea

Cada tarea de la Scraping API sigue el mismo ciclo de vida de tres pasos. Las tareas rápidas devuelven los datos directamente; las tareas de mayor duración cambian a un flujo asíncrono, con sondeo para obtener los resultados.

  1. Enviar una tarea — Envíe una POST solicitud a /api/v1/scraper/request.
  2. Gestionar la respuesta
    1. HTTP 200 (Éxito): Los datos se devuelven directamente en el cuerpo de la respuesta.
    2. HTTP 201 (Procesando): Utilice el taskId proporcionado para sondear los resultados.
  3. Sondear los resultados — Para tareas asincrónicas, llame repetidamente al /api/v1/scraper/result/{taskId} hasta que los datos estén listos (HTTP 200).

Para obtener la lista completa de códigos de estado y orientación sobre el sondeo, consulte Resultados y sondeo. Para recibir resultados mediante un retorno de llamada en lugar de sondear, consulte Webhooks.

Información de Facturación

  1. Los cargos se aplican por solicitud.
  2. Solo las solicitudes exitosas serán facturadas.