Tài liệuCông cụ dành cho nhà phát triểnScrapeless MCPTổng quan

Tổng quan

Scrapeless MCP Server là bản tích hợp Model Context Protocol chính thức dành cho Scrapeless. Nó mang đến cho các LLM, AI agent và các công cụ AI-native — ChatGPT, Claude, Cursor, Windsurf và bất kỳ client tương thích MCP nào — quyền truy cập web theo thời gian thực thông qua một máy chủ hợp nhất duy nhất.

Chỉ với một máy chủ, bạn có thể:

  • Tìm kiếm Google SERPs, Trends, Scholar, Flights và nhiều hơn nữa
  • Thu thập dữ liệu bất kỳ trang nào dưới dạng HTML, Markdown hoặc ảnh chụp màn hình — vượt qua Cloudflare và các cơ chế chống bot khác
  • Crawl toàn bộ website với độ sâu có thể cấu hình và nhắm mục tiêu URL theo phạm vi
  • Tự động hóa một trình duyệt đám mây có khả năng mở rộng: điều hướng, nhấp, gõ, cuộn và trích xuất

Vì sao chọn Scrapeless MCP

Không giống các máy chủ MCP tự động hóa trình duyệt cục bộ, Scrapeless chạy hoàn toàn trên đám mây, mang đến cho các nhà phát triển và AI agent quy mô cùng độ tin cậy ở cấp độ sản xuất:

  • Không cần thiết lập cục bộ — không phải bảo trì các file nhị phân trình duyệt, driver hay cấu hình headless.
  • Đồng thời không giới hạn — khởi chạy 50–1000+ phiên song song với hạ tầng tự động mở rộng.
  • Tích hợp sẵn khả năng chống phát hiện — reCAPTCHA, Cloudflare Turnstile và AWS WAF được xử lý tự động.
  • Phủ sóng IP toàn cầu — các pool residential, ISP và không giới hạn tại hơn 195 quốc gia.
  • Một API token — một khóa Scrapeless duy nhất mở khóa mọi sản phẩm thông qua cùng một máy chủ.

Scrapeless MCP so với các MCP trình duyệt bên thứ ba

Scrapeless MCP là máy chủ đa sản phẩm của riêng Scrapeless. Nó khác biệt với các máy chủ MCP trình duyệt bên thứ ba kết nối tới Scrapeless Cloud Browser như một backend:

MCP ServerTech StackPhù hợp nhất cho
Scrapeless MCPCloud ServiceTìm kiếm, thu thập dữ liệu, crawl và tự động hóa trình duyệt trên mọi sản phẩm Scrapeless từ bất kỳ client MCP nào.
Chrome DevTools MCPNode.js / PuppeteerTự động hóa CI/CD, quy trình làm việc đa IDE và kiểm toán hiệu năng chuyên sâu.
Playwright MCPNode.js / PlaywrightTự động hóa mang tính xác định, dựa trên cây accessibility, chống chịu tốt trước các thay đổi giao diện nhỏ.

Chrome DevTools MCP và Playwright MCP là các bản tích hợp chạy một MCP bên thứ ba dựa trên Scrapeless Cloud Browser. Phần này ghi lại tài liệu về máy chủ MCP của riêng Scrapeless. Xem Các bản tích hợp liên quan để biết các tùy chọn bên thứ ba.

Nội dung trong phần này

Trình diễn

Trường hợp 1: Tương tác web và trích xuất dữ liệu với Claude

Sử dụng Scrapeless MCP Server, Claude có thể thực hiện các thao tác web phức tạp — điều hướng, nhấp, cuộn và thu thập dữ liệu — thông qua các lệnh hội thoại, với xem trước thực thi theo thời gian thực qua các phiên trực tiếp.

browser-mcp-case-1.gif

Trường hợp 2: Vượt qua Cloudflare để lấy nội dung trang mục tiêu

Sử dụng Scrapeless MCP Server, các trang được bảo vệ bởi Cloudflare được truy cập tự động, và sau khi hoàn tất, nội dung trang được trích xuất và trả về ở định dạng Markdown.

browser-mcp-case-2.gif