Activepieces
Activepiecesとは?
Activepieces は、オープンソースでAIを最優先したノーコードビジネス自動化プラットフォームであり、強力なブラウザ自動化機能を備えたZapierのセルフホスト型代替品です。
ScrapelessはActivepiecesで以下のモジュールを提供しています:
- Google Search – Googleからの豊富な検索データにアクセスして取得します。
- Google Trends - キーワードの人気や検索関心の推移を追跡するためにGoogle Trendsのデータを抽出します。
- 汎用スクレイピング – 通常はボットをブロックするJavaScriptレンダリングサイトからデータにアクセスして抽出します。
- 単一ページからデータをスクレイプする – 単一のウェブページから情報を抽出します。
- すべてのページからデータをクロールする – ウェブサイトとそのリンクされたページをクロールして包括的なデータを抽出します。

はじめに
ステップ1. あなたのScrapelessのAPIキーを取得
- アカウントを作成し 、Scrapelessダッシュボードにログインします。 無料で2,000回のAPI呼び出しが利用可能です。
- Scrapeless API キーを生成します。

ステップ2. トリガー条件を設定しScrapelessに接続
- 実際のニーズに基づいてトリガー条件を設定します。

- Scrapelessアカウントを接続します。ここでは 汎用スクレイピング を選択し、
https://www.amazon.com/LK-Apple-Watch-Screen-Protector/dp/B0DFG31G1P/をサンプルのURLとして使用します。


ステップ3. データをクリーンアップ
次に、前の手順でスクレイピングしたHTMLデータを整形します。まず 汎用スクレイピングデータ を、 入力 セクションで選択します。コードの設定は次のとおりです:

export const code = async (inputs) => {
const html = inputs.SOURCE_DATA
const titleMatch = html.match(/id=['"]productTitle['"][^>]*>([^<]+)</i);
const title = titleMatch ? titleMatch[1].trim() : "";
const priceMatch = html.match(/class=['"]a-offscreen['"][^>]*>\$?([\d.,]+)/i);
const price = priceMatch ? priceMatch[1].trim() : "";
const ratingMatch = html.match(/class=['"]a-icon-alt['"][^>]*>([^<]+)</i);
const rating = ratingMatch ? ratingMatch[1].trim() : "";
return [
{
json: {
title,
price,
rating
},
},
];
};
ステップ4. Google Sheetsに接続
次に、クリーンアップされ構造化されたデータをGoogle Sheetsに出力することもできます。単にGoogle Sheetsノードを追加し、Google Sheetsの接続を構成してください。
注意:事前にGoogle Sheetを作成しておいてください。

出力結果の例

以上で、Scrapelessの設定と使用方法の簡単なチュートリアルです。ご質問がある場合は、 ScrapelessDiscordで自由にご相談ください。