Tài liệuCông cụ dành cho nhà phát triểnScrapeless MCPCông cụ theo sản phẩm

Công cụ theo sản phẩm

Scrapeless MCP Server cung cấp các công cụ trên toàn nền tảng Scrapeless thông qua một kết nối duy nhất. Các công cụ dưới đây được nhóm theo sản phẩm mà chúng ánh xạ tới. Khả năng khả dụng có thể thay đổi khi server phát triển — hãy kiểm tra kho lưu trữ để có danh sách chính xác và cập nhật nhất.

Browser

Tự động hóa cloud-browser đầy đủ — điều hướng, tương tác và trích xuất từ các trang trực tiếp.

Công cụMô tả
browser_createTạo hoặc tái sử dụng một phiên cloud browser bằng Scrapeless.
browser_closeĐóng phiên hiện tại bằng cách ngắt kết nối cloud browser.
browser_gotoĐiều hướng trình duyệt tới một URL được chỉ định.
browser_go_backQuay lại một bước trong lịch sử trình duyệt.
browser_go_forwardTiến tới một bước trong lịch sử trình duyệt.
browser_clickNhấp vào một phần tử cụ thể trên trang.
browser_typeNhập văn bản vào một trường nhập liệu được chỉ định.
browser_press_keyMô phỏng một lần nhấn phím.
browser_wait_forChờ một phần tử trang cụ thể xuất hiện.
browser_waitTạm dừng thực thi trong một khoảng thời gian cố định.
browser_screenshotChụp ảnh màn hình của trang hiện tại.
browser_get_htmlLấy toàn bộ HTML của trang hiện tại.
browser_get_textLấy toàn bộ văn bản hiển thị từ trang hiện tại.
browser_scrollCuộn xuống cuối trang.
browser_scroll_toCuộn để đưa một phần tử cụ thể vào tầm nhìn.

Xem tài liệu Agent Browser để tìm hiểu sản phẩm nền tảng.

Crawl

Duyệt toàn bộ các trang web với độ sâu có thể cấu hình và nhắm mục tiêu URL theo phạm vi, sau đó trả về nội dung có cấu trúc.

Công cụMô tả
crawlThu thập dữ liệu một trang web bắt đầu từ một URL, với độ sâu và phạm vi có thể cấu hình, trả về nội dung cho từng trang.
scrapeTrích xuất một URL đơn lẻ và trả về nội dung của nó (xem Web Unlocker bên dưới để biết các định dạng nền tảng).

Xem tài liệu Crawl để tìm hiểu sản phẩm nền tảng.

AI Scraper

Trích xuất các câu trả lời và nội dung có cấu trúc từ AI và các bề mặt tìm kiếm thông qua các truy vấn hội thoại. Các công cụ này ánh xạ tới sản phẩm AI Scraper; hãy gọi chúng bằng cách yêu cầu client của bạn nhắm tới nguồn mục tiêu (ví dụ Google AI Overview) và Scrapeless sẽ định tuyến yêu cầu.

Web Unlocker

Lấy bất kỳ trang nào — bao gồm cả các trang được kết xuất bằng JS và các trang được bảo vệ bởi Cloudflare — dưới dạng HTML, Markdown hoặc ảnh chụp màn hình.

Công cụMô tả
scrape_htmlTrích xuất một URL và trả về toàn bộ nội dung HTML của nó.
scrape_markdownTrích xuất một URL và trả về nội dung của nó dưới dạng Markdown.
scrape_screenshotChụp ảnh màn hình chất lượng cao của bất kỳ trang web nào.

Xem tài liệu Web Unlocker để tìm hiểu sản phẩm nền tảng.

Scraping API

Truy vấn Google và các nguồn có cấu trúc khác thông qua Scraping API.

Công cụMô tả
scrape_googleTruy xuất dữ liệu Google SERP — hỗ trợ các miền được bản địa hóa, phân trang, các tham số gl/hl và các toán tử nâng cao (site:, inurl:, intitle:).
google_trendsTruy xuất dữ liệu Google Trends: mức độ quan tâm theo thời gian, mức độ quan tâm theo khu vực, các truy vấn liên quan và các chủ đề liên quan.

Các bề mặt Google bổ sung (Scholar, Flights, Hotels, Jobs, Maps) có sẵn thông qua sản phẩm con Google Search.

Proxies

Định tuyến các yêu cầu qua Scrapeless Proxies với các pool IP residential, ISP và không giới hạn trên hơn 195 quốc gia. Hành vi proxy được cấu hình theo từng phiên thay vì được cung cấp dưới dạng các công cụ độc lập — xem Configuration.