連携Activepieces

Activepieces

Activepiecesとは?

Activepieces は、オープンソースでAIを最優先したノーコードビジネス自動化プラットフォームであり、強力なブラウザ自動化機能を備えたZapierのセルフホスト型代替品です。

ScrapelessはActivepiecesで以下のモジュールを提供しています:

  1. Google Search – Googleからの豊富な検索データにアクセスして取得します。
  2. Google Trends - キーワードの人気や検索関心の推移を追跡するためにGoogle Trendsのデータを抽出します。
  3. 汎用スクレイピング – 通常はボットをブロックするJavaScriptレンダリングサイトからデータにアクセスして抽出します。
  4. 単一ページからデータをスクレイプする – 単一のウェブページから情報を抽出します。
  5. すべてのページからデータをクロールする – ウェブサイトとそのリンクされたページをクロールして包括的なデータを抽出します。

はじめに

ステップ1. あなたのScrapelessのAPIキーを取得

  • アカウントを作成し 、Scrapelessダッシュボードにログインします。 無料で2,000回のAPI呼び出しが利用可能です。
  • Scrapeless API キーを生成します。

ステップ2. トリガー条件を設定しScrapelessに接続

  1. 実際のニーズに基づいてトリガー条件を設定します。

  1. Scrapelessアカウントを接続します。ここでは 汎用スクレイピング を選択し、 https://www.amazon.com/LK-Apple-Watch-Screen-Protector/dp/B0DFG31G1P/ をサンプルのURLとして使用します。


ステップ3. データをクリーンアップ

次に、前の手順でスクレイピングしたHTMLデータを整形します。まず 汎用スクレイピングデータ を、 入力 セクションで選択します。コードの設定は次のとおりです:

export const code = async (inputs) => {
const html = inputs.SOURCE_DATA
 
const titleMatch = html.match(/id=['"]productTitle['"][^>]*>([^<]+)</i);
const title = titleMatch ? titleMatch[1].trim() : "";
 
const priceMatch = html.match(/class=['"]a-offscreen['"][^>]*>\$?([\d.,]+)/i);
const price = priceMatch ? priceMatch[1].trim() : "";
 
const ratingMatch = html.match(/class=['"]a-icon-alt['"][^>]*>([^<]+)</i);
const rating = ratingMatch ? ratingMatch[1].trim() : "";
 
return [
  {
    json: {
      title,
      price,
      rating
    },
  },
];
};
 

ステップ4. Google Sheetsに接続

次に、クリーンアップされ構造化されたデータをGoogle Sheetsに出力することもできます。単にGoogle Sheetsノードを追加し、Google Sheetsの接続を構成してください。

注意:事前にGoogle Sheetを作成しておいてください。

出力結果の例

以上で、Scrapelessの設定と使用方法の簡単なチュートリアルです。ご質問がある場合は、 ScrapelessDiscordで自由にご相談ください。