Tổng quan nền tảng
Xây dựng cùng Scrapeless.
Hướng dẫn, hướng dẫn nhanh, SDK và các tích hợp cho Agent Browser, Crawl, AI Scraper, Web Unlocker, Proxies và Scraping API.
Bắt đầu với hướng dẫn nhanh · Chọn sản phẩm phù hợp · Tài liệu tham khảo API
Khám phá nền tảng
Browser & Crawl
Dùng Agent Browser khi quy trình làm việc của bạn cần một trình duyệt mà bạn có thể điều khiển: điều hướng trang, điền biểu mẫu, nhấp vào các phần tử và quản lý phiên với Playwright hoặc Puppeteer. Dùng Crawl khi điểm khởi đầu của bạn là một URL hoặc một tập hợp URL và mục tiêu của bạn là thu thập nội dung trang, bao gồm Markdown, HTML hoặc các liên kết.
Hướng dẫn Agent Browser · Hướng dẫn Crawl
AI Scraper
Thu thập câu trả lời từ các công cụ AI được hỗ trợ để giám sát thương hiệu, so sánh câu trả lời và nghiên cứu. Gửi các prompt, sau đó truy xuất kết quả của các tác vụ đã hoàn thành. Các trường khả dụng phụ thuộc vào từng công cụ và có thể bao gồm văn bản phản hồi cùng các trích dẫn.
Web Unlocker
Yêu cầu nội dung từ một URL mục tiêu trong khi Scrapeless xử lý các thách thức truy cập được hỗ trợ. Thêm kết xuất JavaScript khi nội dung phụ thuộc vào các tập lệnh. Sử dụng nội dung được trả về trong quy trình phân tích hoặc xử lý của riêng bạn.
Proxies
Định tuyến các yêu cầu từ trình duyệt, HTTP client hoặc ứng dụng của riêng bạn thông qua các proxy dân cư (residential), ISP tĩnh (static ISP), trung tâm dữ liệu (datacenter) hoặc IPv6. Chọn hướng đi này khi bạn đã tự quản lý logic thu thập và cần kiểm soát việc định tuyến mạng.
Scraping API
Lấy dữ liệu có cấu trúc từ các nguồn cụ thể với Google Search API, Amazon Scraper, TikTok Scraper. Chọn scraper cho nguồn mục tiêu của bạn, sau đó làm theo hướng dẫn của nó về các đầu vào được hỗ trợ và các trường đầu ra.
- Google Search API: truy xuất kết quả tìm kiếm Google có cấu trúc.
- Amazon Scraper: thu thập dữ liệu Amazon có cấu trúc.
- TikTok Scraper: thu thập dữ liệu TikTok có cấu trúc.
Công cụ dành cho nhà phát triển
Chọn một giao diện phù hợp với các khả năng sản phẩm mà quy trình làm việc của bạn cần.
Scrapeless MCP
Kết nối AI agent của bạn với Scrapeless thông qua một điểm truy cập MCP duy nhất. Sử dụng tổng quan Scrapeless MCP và Công cụ theo sản phẩm để khám phá các khả năng trên Agent Browser, Crawl, AI Scraper, Web Unlocker, Scraping API và Proxies. Làm theo hướng dẫn thiết lập client và xác thực phù hợp với môi trường của bạn.
SDKs
Dùng một SDK để gọi Scrapeless từ ứng dụng của bạn. Bắt đầu với tổng quan SDK, sau đó chọn ngôn ngữ của bạn:
CLI
Scrapeless CLI là điểm truy cập dòng lệnh được lên kế hoạch cho các quy trình làm việc dựa trên terminal. Sắp ra mắt. Tài liệu của nó sẽ đề cập đến việc cài đặt và nâng cấp, xác thực và cấu hình, các lệnh, ví dụ và khắc phục sự cố.
Các tích hợp phổ biến
Kết nối Scrapeless với các công cụ hiện có của bạn thông qua danh mục Tích hợp:
- Tự động hóa quy trình làm việc: n8n, Make, Pipedream và Activepieces.
- Công cụ AI và agent: Dify, Claude, Cursor, Cline và LangChain.
- Thư viện và framework trình duyệt: Puppeteer, Playwright, Selenium, Stagehand, Browser Use, Crawl4AI và Scrapling.
- Bộ điều hợp MCP cho Agent Browser: Chrome DevTools MCP và Playwright MCP.
- Tích hợp proxy: Nstbrowser.
Sử dụng danh mục này để tìm hướng dẫn thiết lập cho từng công cụ. Scrapeless MCP là một công cụ dành cho nhà phát triển của nền tảng; các bộ điều hợp MCP của bên thứ ba kết nối client của họ với Agent Browser.
Bắt đầu xây dựng
Mới sử dụng Scrapeless? Làm theo Hướng dẫn nhanh để gửi một yêu cầu và kiểm tra kết quả của nó. Nếu bạn đã có sẵn một tác vụ trong đầu, hãy dùng Chọn sản phẩm phù hợp để tìm hướng dẫn cho nó.
Trước khi kết nối một ứng dụng, hãy đọc Lấy và bảo vệ API key của bạn.