ドキュメント利用を始める適切な製品を選ぶ

適切な製品を選ぶ

アプリケーションが完了させる必要がある作業とその結果から始めましょう。ブラウザセッション、ページコンテンツ、AIの回答、検索結果はそれぞれ異なる出発点を必要とします。

タスクと照らし合わせる

あなたのタスク始めるにあたってあなたが提供するもの扱うもの
サイトをナビゲートし、フォームに入力し、要素をクリック、またはセッションベースのワークフローを実行するAgent Browserブラウザ自動化コードとセッション設定コードで制御されるブラウザセッション
1ページ、ページのリスト、またはサイトにまたがるリンクされたページを収集するクローリングURLおよびスクレイピングまたはクロールのオプションMarkdown、HTML、リンクなど選択された形式のページコンテンツ
サポートされているAIエンジンから回答と利用可能な引用を収集するAI Scraperエンジンの選択、プロンプト、およびサポートされているパラメータそのエンジンによるタスク完了結果
管理されたアクセス処理付きのURLからコンテンツを取得するWeb Unlocker対象のURLおよびリクエストまたはレンダリングオプションアプリケーション内で解析または処理するコンテンツ
すでに実行しているコレクターやブラウザにIPルーティングを追加するProxiesあなたのトラフィックとプロキシ設定選択されたプロキシネットワークを通じてルーティングされたリクエスト
Google検索結果を取得するScraping API: Google Search APIクエリと検索パラメータ構造化された検索結果
Amazonからデータを収集するScraping API: Amazon Scraper選択したAmazonスクレイピングアクションの入力構造化されたAmazonデータ
TikTokからデータを収集するScraping API: TikTok Scraper選択したTikTokスクレイピングアクションの入力構造化されたTikTokデータ
AIエージェントに複数のScrapeless製品を呼び出させるScrapeless MCPMCPクライアントを通じて発行されたタスク選択された製品ツールからの結果

類似のオプションの間で選択する

Agent BrowserまたはCrawl?

プログラムがブラウザ内で次に何を行うかを決定する必要がある場合に、 Agent Browser を選択してください。たとえば、要素の検査、クリック後のナビゲーション、認証済みワークフローの継続などです。

推奨する製品は Crawl です。URLsとオプションで収集処理を指定できる場合に適しています。たとえば、検索パイプライン用のドキュメントページの収集には通常Crawlを使用し、複数手順からなるポータルの操作を自動化する場合にはAgent Browserを使用します。

CrawlまたはWeb Unlocker?

推奨する製品は Crawl です。管理されたコンテンツ収集ワークフローが必要な場合、特にURLの一覧を処理したり、サイト全体でリンク先のページを検出したりする場合に適しています。

推奨する製品は Web Unlocker です。アプリケーション側でリクエスト先のURLとレスポンスの処理方法を決めている場合に適しています。JavaScriptレンダリングのオプションでは、リクエスト単位の命令や出力形式も指定できます。選択基準は管理するワークフローであり、単にページがJavaScriptを使用しているかどうかではありません。

Web UnlockerまたはProxies?

コンテンツリクエストに加えて、サポートされるアクセス処理を委任したい場合は、 Web Unlocker を選択してください。

推奨する製品は Proxies です。既存のブラウザやHTTPクライアントを引き続き使用し、レンダリング、解析、再試行のロジックを自分で管理する場合に適しています。プロキシはトラフィックを中継し、ページの収集方法と解釈方法はアプリケーション側で決定します。

AI ScraperまたはScraping API?

入力がプロンプトであり、ChatGPT や Perplexity などのサポート対象AIエンジンから回答を得たい場合は、 AI Scraper を選択してください。

推奨する製品は Scraping API です。Google Search、Amazon、TikTokから構造化データを取得する場合に適しています。必要なソースに応じて、 Google Search API、 Amazon Scraper、 TikTok Scraper から開始してください。AIの回答を取得する場合は、対応するAI Scraperエンジンのガイドとサポートされるフィールドを確認してください。

Amazon Scraper はScraping APIに属しています。 Amazon Alexaは、異なる目的を持つAIエンジンのオプションとして、AI Scraperの下にリストされています。

エンジンおよびスクレイパーのサポートは各ガイドに固有です。構築を始める前に、必要なソースとフィールドがドキュメント化されていることを確認してください。

統合方法を選択

製品を選択した後、アプリケーションに合ったインターフェースを選んでください:

構築方法出発点
任意の言語から直接エンドポイントを呼び出したい場合API リファレンス
Node.jsまたはTypeScriptを使用し、SDKメソッドを希望する場合Node.js SDK
Pythonを使用し、SDKメソッドを希望する場合Python SDK
Goを使用し、SDKメソッドを希望する場合Go SDK
AIエージェントにサポートされているScrapelessツールを呼び出させたい場合Scrapeless MCP
コマンドラインインターフェースを好むScrapelessCLI — 近日公開
既存のワークフローまたはエージェントツールを接続したい統合カタログ

PythonおよびGo用SDKは開発中です。CLIも「近日登場」の予約エントリとしています。これらのSDKの準備が整うまでは、REST APIをこれらの言語から直接呼び出すことができます。

SDKまたはMCPサーバーは、サポートされている機能へのインターフェースを提供します。選択した製品に対して、現在利用可能なメソッドまたはツールを確認してください。

代表的な小さなタスクを試してみる

1つのURL、1つのプロンプト、または1つの検索クエリから始めましょう。より大きなジョブに拡大する前に、返されたフィールドと結果が要件を満たしているか確認してください。

基本的な認証とリクエストの流れをまず学びたい場合は、プラットフォームの クイックスタートに従ってください。