Chọn sản phẩm phù hợp
Hãy bắt đầu từ công việc bạn cần hoàn thành và kết quả mà ứng dụng của bạn cần. Một phiên trình duyệt, nội dung trang, một câu trả lời AI và một kết quả tìm kiếm mỗi thứ đều đòi hỏi một điểm khởi đầu khác nhau.
Ghép với nhiệm vụ của bạn
| Nhiệm vụ của bạn | Bắt đầu với | Bạn cung cấp | Bạn làm việc với |
|---|---|---|---|
| Điều hướng một trang web, điền biểu mẫu, nhấp vào các phần tử hoặc chạy một quy trình dựa trên phiên | Agent Browser | Mã tự động hóa trình duyệt và cấu hình phiên | Một phiên trình duyệt được điều khiển bởi mã của bạn |
| Thu thập một trang, một danh sách các trang hoặc các trang được liên kết trên khắp một trang web | Crawl | URL và các tùy chọn scrape hoặc crawl | Nội dung trang ở các định dạng đã chọn, chẳng hạn như Markdown, HTML và các liên kết |
| Thu thập câu trả lời và các trích dẫn có sẵn từ các engine AI được hỗ trợ | AI Scraper | Lựa chọn engine, prompt và các tham số được hỗ trợ | Kết quả tác vụ đã hoàn thành cho engine đó |
| Truy xuất nội dung từ một URL với việc xử lý truy cập được quản lý | Web Unlocker | Một URL đích và các tùy chọn request hoặc rendering | Nội dung để phân tích cú pháp hoặc xử lý trong ứng dụng của bạn |
| Thêm định tuyến IP vào một trình thu thập hoặc trình duyệt mà bạn đã chạy sẵn | Proxies | Lưu lượng và cấu hình proxy của bạn | Các request được định tuyến qua mạng proxy đã chọn |
| Nhận kết quả tìm kiếm Google | Scraping API: Google Search API | Một truy vấn và các tham số tìm kiếm | Kết quả tìm kiếm có cấu trúc |
| Thu thập dữ liệu từ Amazon | Scraping API: Amazon Scraper | Dữ liệu đầu vào cho hành động scraping Amazon đã chọn | Dữ liệu Amazon có cấu trúc |
| Thu thập dữ liệu từ TikTok | Scraping API: TikTok Scraper | Dữ liệu đầu vào cho hành động scraping TikTok đã chọn | Dữ liệu TikTok có cấu trúc |
| Cho phép một AI agent gọi nhiều sản phẩm Scrapeless | Scrapeless MCP | Các tác vụ được phát hành thông qua một MCP client | Kết quả từ các công cụ sản phẩm đã chọn |
Quyết định giữa các tùy chọn tương tự
Agent Browser hay Crawl?
Chọn Agent Browser khi chương trình của bạn cần quyết định phải làm gì tiếp theo bên trong một trình duyệt: kiểm tra một phần tử, điều hướng sau khi nhấp chuột hoặc tiếp tục một quy trình đã xác thực.
Chọn Crawl khi bạn có thể mô tả công việc thu thập bằng URL và các tùy chọn. Ví dụ, việc thu thập các trang tài liệu cho một pipeline truy xuất thường bắt đầu với Crawl; việc tự động hóa một quy trình cổng thông tin gồm nhiều bước bắt đầu với Agent Browser.
Crawl hay Web Unlocker?
Chọn Crawl cho một quy trình thu thập nội dung được quản lý, đặc biệt khi bạn cần xử lý một danh sách URL hoặc khám phá các trang được liên kết trên khắp một trang web.
Chọn Web Unlocker khi ứng dụng của bạn đã tự quyết định URL nào cần request và cách xử lý phản hồi. Các tùy chọn rendering JavaScript của nó cũng hỗ trợ các chỉ dẫn ở cấp request và các định dạng đầu ra. Sự lựa chọn phụ thuộc vào quy trình mà bạn muốn quản lý, chứ không đơn giản là liệu trang có sử dụng JavaScript hay không.
Web Unlocker hay Proxies?
Chọn Web Unlocker để ủy thác việc xử lý truy cập được hỗ trợ cùng với request nội dung.
Chọn Proxies khi bạn muốn giữ lại trình duyệt hoặc HTTP client hiện có của mình và tự quản lý logic rendering, phân tích cú pháp và thử lại. Một proxy định tuyến lưu lượng; ứng dụng của bạn vẫn quyết định cách thu thập và diễn giải trang.
AI Scraper hay Scraping API?
Chọn AI Scraper khi dữ liệu đầu vào của bạn là một prompt và bạn muốn một câu trả lời từ một engine AI được hỗ trợ, chẳng hạn như ChatGPT hoặc Perplexity.
Chọn Scraping API khi bạn muốn dữ liệu có cấu trúc từ Google Search, Amazon hoặc TikTok. Hãy bắt đầu với Google Search API, Amazon Scraper hoặc TikTok Scraper cho nguồn bạn cần. Để có trải nghiệm câu trả lời AI, hãy kiểm tra hướng dẫn engine AI Scraper tương ứng và các trường được hỗ trợ của nó.
Amazon Scraper thuộc về Scraping API. Amazon Alexa, được liệt kê trong AI Scraper, là một tùy chọn engine AI với một mục đích khác.
Sự hỗ trợ của engine và scraper là riêng biệt cho từng hướng dẫn. Hãy kiểm tra xem nguồn và các trường bạn cần có được ghi trong tài liệu hay không trước khi xây dựng dựa trên chúng.
Chọn phương thức tích hợp của bạn
Sau khi chọn một sản phẩm, hãy chọn một giao diện phù hợp với ứng dụng của bạn:
| Cách bạn xây dựng | Điểm khởi đầu |
|---|---|
| Bạn muốn gọi các endpoint trực tiếp từ bất kỳ ngôn ngữ nào | API Reference |
| Bạn sử dụng Node.js hoặc TypeScript và muốn các phương thức SDK | Node.js SDK |
| Bạn sử dụng Python và muốn các phương thức SDK | Python SDK |
| Bạn sử dụng Go và muốn các phương thức SDK | Go SDK |
| Bạn muốn một AI agent gọi các công cụ Scrapeless được hỗ trợ | Scrapeless MCP |
| Bạn thích một giao diện dòng lệnh | Scrapeless CLI — Sắp ra mắt |
| Bạn muốn kết nối một quy trình hoặc công cụ agent hiện có | Danh mục tích hợp |
SDK cho Python và Go đang được phát triển. CLI cũng được dành sẵn như một mục Sắp ra mắt. Bạn có thể gọi trực tiếp các REST API từ một trong hai ngôn ngữ trong khi các SDK đó đang được chuẩn bị.
Một SDK hoặc MCP server cung cấp một giao diện cho các khả năng được hỗ trợ. Hãy xác minh các phương thức hoặc công cụ hiện có của nó cho sản phẩm bạn đã chọn.
Thử một nhiệm vụ nhỏ mang tính đại diện
Hãy bắt đầu với một URL, một prompt hoặc một truy vấn tìm kiếm. Kiểm tra các trường được trả về và liệu kết quả có đáp ứng nhu cầu của bạn hay không trước khi mở rộng sang một công việc lớn hơn.
Nếu bạn muốn tìm hiểu về luồng xác thực và request cơ bản trước, hãy làm theo Quickstart của nền tảng.