Công cụ theo sản phẩm
Scrapeless MCP Server cung cấp các công cụ trên toàn nền tảng Scrapeless thông qua một kết nối duy nhất. Các công cụ dưới đây được nhóm theo sản phẩm mà chúng ánh xạ tới. Khả năng khả dụng có thể thay đổi khi server phát triển — hãy kiểm tra kho lưu trữ để có danh sách chính xác và cập nhật nhất.
Browser
Tự động hóa cloud-browser đầy đủ — điều hướng, tương tác và trích xuất từ các trang trực tiếp.
| Công cụ | Mô tả |
|---|---|
browser_create | Tạo hoặc tái sử dụng một phiên cloud browser bằng Scrapeless. |
browser_close | Đóng phiên hiện tại bằng cách ngắt kết nối cloud browser. |
browser_goto | Điều hướng trình duyệt tới một URL được chỉ định. |
browser_go_back | Quay lại một bước trong lịch sử trình duyệt. |
browser_go_forward | Tiến tới một bước trong lịch sử trình duyệt. |
browser_click | Nhấp vào một phần tử cụ thể trên trang. |
browser_type | Nhập văn bản vào một trường nhập liệu được chỉ định. |
browser_press_key | Mô phỏng một lần nhấn phím. |
browser_wait_for | Chờ một phần tử trang cụ thể xuất hiện. |
browser_wait | Tạm dừng thực thi trong một khoảng thời gian cố định. |
browser_screenshot | Chụp ảnh màn hình của trang hiện tại. |
browser_get_html | Lấy toàn bộ HTML của trang hiện tại. |
browser_get_text | Lấy toàn bộ văn bản hiển thị từ trang hiện tại. |
browser_scroll | Cuộn xuống cuối trang. |
browser_scroll_to | Cuộn để đưa một phần tử cụ thể vào tầm nhìn. |
Xem tài liệu Agent Browser để tìm hiểu sản phẩm nền tảng.
Crawl
Duyệt toàn bộ các trang web với độ sâu có thể cấu hình và nhắm mục tiêu URL theo phạm vi, sau đó trả về nội dung có cấu trúc.
| Công cụ | Mô tả |
|---|---|
crawl | Thu thập dữ liệu một trang web bắt đầu từ một URL, với độ sâu và phạm vi có thể cấu hình, trả về nội dung cho từng trang. |
scrape | Trích xuất một URL đơn lẻ và trả về nội dung của nó (xem Web Unlocker bên dưới để biết các định dạng nền tảng). |
Xem tài liệu Crawl để tìm hiểu sản phẩm nền tảng.
AI Scraper
Trích xuất các câu trả lời và nội dung có cấu trúc từ AI và các bề mặt tìm kiếm thông qua các truy vấn hội thoại. Các công cụ này ánh xạ tới sản phẩm AI Scraper; hãy gọi chúng bằng cách yêu cầu client của bạn nhắm tới nguồn mục tiêu (ví dụ Google AI Overview) và Scrapeless sẽ định tuyến yêu cầu.
Web Unlocker
Lấy bất kỳ trang nào — bao gồm cả các trang được kết xuất bằng JS và các trang được bảo vệ bởi Cloudflare — dưới dạng HTML, Markdown hoặc ảnh chụp màn hình.
| Công cụ | Mô tả |
|---|---|
scrape_html | Trích xuất một URL và trả về toàn bộ nội dung HTML của nó. |
scrape_markdown | Trích xuất một URL và trả về nội dung của nó dưới dạng Markdown. |
scrape_screenshot | Chụp ảnh màn hình chất lượng cao của bất kỳ trang web nào. |
Xem tài liệu Web Unlocker để tìm hiểu sản phẩm nền tảng.
Scraping API
Truy vấn Google và các nguồn có cấu trúc khác thông qua Scraping API.
| Công cụ | Mô tả |
|---|---|
scrape_google | Truy xuất dữ liệu Google SERP — hỗ trợ các miền được bản địa hóa, phân trang, các tham số gl/hl và các toán tử nâng cao (site:, inurl:, intitle:). |
google_trends | Truy xuất dữ liệu Google Trends: mức độ quan tâm theo thời gian, mức độ quan tâm theo khu vực, các truy vấn liên quan và các chủ đề liên quan. |
Các bề mặt Google bổ sung (Scholar, Flights, Hotels, Jobs, Maps) có sẵn thông qua sản phẩm con Google Search.
Proxies
Định tuyến các yêu cầu qua Scrapeless Proxies với các pool IP residential, ISP và không giới hạn trên hơn 195 quốc gia. Hành vi proxy được cấu hình theo từng phiên thay vì được cung cấp dưới dạng các công cụ độc lập — xem Configuration.