Browser Use

让 AI Agent 操作浏览器完成点击、填写表单、数据提取和网页测试的开源 Python 工具

📅 收录: 2026-07-22 🔄 更新: 2026-07-22

这是什么?

Browser Use 是一个开源 Python 工具,让 AI Agent 能像用户一样打开网页、点击、输入、填写表单和提取数据。它既提供本地 Python 库,也提供托管云服务,适合网页信息处理、表单自动化和网站质量检查。

2026-07-22 核实时,官方 GitHub 仓库采用 MIT 许可,约有 106K Stars。开源库本身免费,但模型 API、云浏览器、代理网络等可能产生费用。

为什么值得关注?

  • 把网页操作封装为 Agent 可调用的浏览器能力。
  • 支持自选模型供应商,也可连接官方托管服务。
  • 提供 Python 库、命令行和 Agent Skill 等使用方式。
  • 社区规模大,文档和示例覆盖表单、抽取与 QA 自动化。

快速上手

准备 Python 3.11 或更高版本,然后安装依赖:

uv add browser-use

配置你选择的模型凭据后,创建一个最小任务:

import asyncio
from browser_use import Agent, ChatBrowserUse

async def main():
    agent = Agent(
        task="打开官方仓库并返回当前 Star 数",
        llm=ChatBrowserUse(),
    )
    await agent.run()

asyncio.run(main())

类名、模型配置和连接方式可能随版本变化,实际使用前应对照当前 README 与官方文档。

适合的场景

  • 从公开网页提取结构化信息并整理为表格。
  • 自动填写重复表单,但提交前保留人工确认。
  • 对测试站点执行导航、交互和视觉一致性检查。
  • 为 Agent 增加必须通过浏览器完成的操作能力。

常见踩坑

把网页内容当成可信指令

网页可能包含提示注入或恶意文本。应限制 Agent 的工具权限、可访问域名和可提交操作,不要让网页内容覆盖系统规则。

直接复用高权限浏览器配置

保存了登录态的浏览器可能访问邮箱、后台和支付页面。建议使用专用配置、最小权限账号和隔离环境。

忽略成本和稳定性

复杂网页会消耗较多模型调用,验证码、反自动化机制和页面改版也可能导致失败。生产任务需要超时、重试和人工兜底。

参考链接

📊 评分与标签

评分说明

总分 8.9/10 · P_优选

📊 可观测社区指标(采集日期:2026-07-22)

⚙️ 功能完整度 2.3/2.5

  • 覆盖浏览器导航、点击、输入、表单与数据抽取等 Agent 常用能力。
  • 同时提供本地库和托管服务;复杂站点仍需额外处理认证、验证码与失败恢复。

✨ 输出质量 2.1/2.5

  • 对结构明确的网页任务可生成可检查的操作过程和结果。
  • 准确度取决于网页变化、模型能力和任务约束,不应无审查执行高风险提交。

🖐️ 易用性 1.3/1.5

  • Python 安装和官方快速开始较直接,并提供多种集成方式。
  • 浏览器依赖、模型凭据和运行隔离仍有一定配置成本。

💰 性价比 1.4/1.5

  • MIT 开源,可自行部署核心库。
  • 模型、云浏览器和代理服务可能产生持续费用。

🔒 稳定性 0.9/1.0

  • 社区活跃且持续发布;网页结构和反自动化策略仍是外部不稳定因素。

🛡️ 隐私安全 0.9/1.0

  • 可本地运行并自选模型,但复用登录态和处理敏感网页时必须采用最小权限与隔离。

📋 来源核实

同分类推荐

AI编程 分类下的其他工具

)}