集成Activepieces

Activepieces

什么是 Activepieces?

Activepieces 是一个开源、AI 优先的无代码业务自动化平台——本质上是 Zapier 的自托管替代方案,具备强大的浏览器自动化能力。

Scrapeless 在 Activepieces 中提供以下模块:

  1. Google Search – 访问并获取来自 Google 的丰富搜索数据。
  2. Google Trends - 提取 Google Trends 数据,跟踪关键词的热度和随时间变化的搜索兴趣。
  3. Universal Scraping – 访问并从通常会拦截机器人的 JS-Render 网站提取数据。
  4. Scrape data from a single page – 从单个网页提取信息。
  5. Crawl data from all pages – 抓取网站及其链接页面,以提取全面的数据。

快速开始

步骤 1. 获取你的 Scrapeless API Key

  • 创建账户 并登录 Scrapeless 控制台。你可以获得 2,000 次免费 API 调用。
  • 生成你的 Scrapeless API key。

步骤 2. 设置触发条件并连接到 Scrapeless

  1. 根据你的实际需求设置触发条件。

  1. 连接你的 Scrapeless 账户。这里我们选择 Universal Scraping,并使用 https://www.amazon.com/LK-Apple-Watch-Screen-Protector/dp/B0DFG31G1P/ 作为示例 URL。


步骤 3. 清洗数据

接下来,我们需要清洗上一步抓取到的 HTML 数据。首先,在 inputs 部分选择 Universal Scraping Data。代码配置如下:

export const code = async (inputs) => {
const html = inputs.SOURCE_DATA
 
const titleMatch = html.match(/id=['"]productTitle['"][^>]*>([^<]+)</i);
const title = titleMatch ? titleMatch[1].trim() : "";
 
const priceMatch = html.match(/class=['"]a-offscreen['"][^>]*>\$?([\d.,]+)/i);
const price = priceMatch ? priceMatch[1].trim() : "";
 
const ratingMatch = html.match(/class=['"]a-icon-alt['"][^>]*>([^<]+)</i);
const rating = ratingMatch ? ratingMatch[1].trim() : "";
 
return [
  {
    json: {
      title,
      price,
      rating
    },
  },
];
};
 

步骤 4. 连接到 Google Sheets

接下来,你可以选择将清洗并结构化后的数据输出到 Google Sheets。只需添加一个 Google Sheets 节点并配置你的 Google Sheets 连接即可。

注意:请务必提前创建好一个 Google Sheet。

输出结果示例

以上就是关于如何设置和使用 Scrapeless 的简单教程。如果你有任何疑问,欢迎在 Scrapeless Discord 上讨论。