集成Browser Use

Browser Use

Browser Use 是一个浏览器自动化 SDK,它使用截图来捕获浏览器的状态,并通过操作来模拟用户交互。本章将介绍如何通过简单的调用,轻松使用 browser-use 在 Web 上执行 agent 任务。

获取 Scrapeless API Key

前往 Dashboard 的 Settings 选项卡:

然后在你的 .env 文件中复制并设置 SCRAPELESS_API_KEY 环境变量。

同样也需要在你的 .env 文件中设置 OPENAI_API_KEY 环境变量。

OPENAI_API_KEY=your-openai-api-key
SCRAPELESS_API_KEY=your-scrapeless-api-key

💡请记得将示例 API key 替换为你自己的实际 API key。

安装 Browser Use

使用 pip 安装(Python>=3.11):

pip install browser-use

如需 memory 功能(由于 PyTorch 兼容性要求 Python<3.13):

pip install "browser-use[memory]"

设置 Browser 和 Agent 配置

以下是配置浏览器并创建自动化 agent 的方法:

from dotenv import load_dotenv
import os
import asyncio
from urllib.parse import urlencode
from browser_use import Agent, Browser, ChatOpenAI
from pydantic import SecretStr
 
task = "Go to Google, search for 'Scrapeless', click on the first post and return to the title"
 
async def setup_browser() -> Browser:
    scrapeless_base_url = "wss://browser.scrapeless.com/api/v2/browser"
    query_params = {
        "token": os.environ.get("SCRAPELESS_API_KEY"),
        "sessionTTL": 900,
        "proxyCountry": "ANY"
    }
    browser_ws_endpoint = f"{scrapeless_base_url}?{urlencode(query_params)}"
    browser = Browser(cdp_url=browser_ws_endpoint)
    return browser
 
async def setup_agent(browser: Browser) -> Agent:
    llm = ChatOpenAI(
        model="gpt-4o", # Or choose the model you want to use
        api_key=SecretStr(os.environ.get("OPENAI_API_KEY")),
    )
 
    return Agent(
        task=task,
        llm=llm,
        browser=browser,
    )

创建主函数

以下是将所有内容整合在一起的主函数:

async def main():
    load_dotenv()
    browser = await setup_browser()
    await browser.start()
    agent = await setup_agent(browser)
    result = await agent.run()
    print(result)
    await browser.kill()
 
asyncio.run(main())

运行你的脚本

运行你的脚本:

python run main.py

你应该会在 Scrapeless Dashboard 中看到你的 Scrapeless 会话启动。

完整代码

from dotenv import load_dotenv
import os
import asyncio
from urllib.parse import urlencode
from browser_use import Agent, Browser, ChatOpenAI
from pydantic import SecretStr
 
task = "Go to Google, search for 'Scrapeless', click on the first post and return to the title"
 
async def setup_browser() -> Browser:
    scrapeless_base_url = "wss://browser.scrapeless.com/api/v2/browser"
    query_params = {
        "token": os.environ.get("SCRAPELESS_API_KEY"),
        "sessionTTL": 900,
        "proxyCountry": "ANY"
    }
    browser_ws_endpoint = f"{scrapeless_base_url}?{urlencode(query_params)}"
    browser = Browser(cdp_url=browser_ws_endpoint)
    return browser
 
async def setup_agent(browser: Browser) -> Agent:
    llm = ChatOpenAI(
        model="gpt-4o", # Or choose the model you want to use
        api_key=SecretStr(os.environ.get("OPENAI_API_KEY")),
    )
 
    return Agent(
        task=task,
        llm=llm,
        browser=browser,
    )
 
async def main():
    load_dotenv()
    browser = await setup_browser()
    await browser.start()
    agent = await setup_agent(browser)
    result = await agent.run()
    print(result)
    await browser.kill()
 
asyncio.run(main())

💡Browser Use 目前仅支持 Python。

💡你可以在 live session 中复制 URL 以实时观看会话进度,也可以在 session history 中观看会话的回放。