← 返回项目库

browser-use/browser-use

browser-use:用自然语言驱动浏览器完成网页操作

browser-use 是一个让 AI Agent 像人一样操作浏览器的 Python 库,通过自然语言指令自动完成网页导航、表单填写、数据抓取等任务。适合需要为 LLM Agent 赋予浏览器交互能力,或希望自动化网页流程的开发者。主要门槛是需要提供 LLM API 密钥,且站点反爬与验证码效果仍存在不确定性。

官方名称:browser-use资料更新:2026/9/10
打开 GitHub
Stars
11.4万
7日增长
+1992
Forks
1.3万
活跃度
100
维护状态
活跃

01WHAT IT SOLVES

这个项目解决什么问题?

browser-use 定位为让大语言模型像人一样使用浏览器的开源代理库,底层基于 Playwright 等浏览器自动化能力,将自然语言任务拆解为可执行的浏览器操作序列。它提供三条使用路径:完全托管的云服务、为 Claude Code、Codex 等已有 Agent 增加浏览器能力的 CLI,以及可嵌入自有代码的 Python 库,可连接本地或云端浏览器。在同类方案中,它强调对多种主流 LLM 的兼容、灵活的工具注册机制以及对真实浏览器配置和身份认证复用的支持,官方还配套推出 BU2 专用模型与 BU Bench V2 基准测试。

02CORE CAPABILITIES

核心能力

01

自然语言驱动的浏览器自动化

通过自然语言指令让 Agent 自动完成网页导航、点击、填表等操作

02

多 LLM 兼容

支持通过 ChatBrowserUse 网关调用 Claude、GPT、Gemini、DeepSeek 等多种模型,并提供 BU2 专用模型

03

多种部署路径

提供托管云、CLI 和 Python 库三种方式,可连接本地或云端浏览器

04

自定义工具与系统提示

允许注册自定义函数工具,并可通过 extend_system_message 或 override_system_message 调整 Agent 行为

05

浏览器配置与认证复用

支持复用本地 Chrome 配置文件,或通过云浏览器同步 Cookie 进行身份认证

03适合谁

  • 需要为 LLM Agent 赋予浏览器操作能力的应用开发者
  • 希望用自然语言自动化网页流程的 Python 工程师
  • 使用 Claude Code、Codex 等已有 Agent 并希望扩展浏览器能力的团队
  • 研究浏览器 Agent 性能与基准的科研人员

04典型使用场景

  • 自动登录并抓取需要认证的网页数据
  • 通过 CLI 给 Claude Code、Codex 等 Agent 赋予浏览器操作能力
  • 自动化表单填写、预约、购票等多步交互网页任务
  • 在自有 Python 应用中嵌入浏览器 Agent 处理动态网页内容

05为什么值得关注

  • 社区关注度高,GitHub Star 数已超过十万
  • 提供 BU2 专用模型与 BU Bench V2 基准测试,便于评估浏览器 Agent 能力
  • 支持本地与云端浏览器两种模式,兼顾隐私与规模化
  • 与 Playwright 等主流浏览器自动化底层深度集成

06采用前要注意

  • 本地模型推理和托管浏览器需自行配置 API 密钥或硬件资源
  • 验证码与反爬机制不能保证完全规避
  • 配置文件同步仅传输 Cookie,不包含 localStorage、IndexedDB 或扩展
  • 依赖 Python 3.11 及以上版本

07RELEASE INTELLIGENCE

近期版本变化

全部版本动态 →

browser-use 0.13.10:依赖全面固定并修复安全公告

本次升级将 Browser Harness 提升至 0.1.13,并对全部运行时、可选、开发与构建依赖进行精确锁定;迁移至 MCP Python SDK 2.1.1,新增 pydantic-settings 为显式运行时依赖,修复 pypdf 的三个 Dependabot 安全公告;同时将未知 MCP 工具调用改为报告为应用错误而非成功结果。影响所有集成该库的用户,建议关注依赖固定带来的兼容性与安全修复。

  • 升级 Browser Harness 至 0.1.13 并迁移到 MCP Python SDK 2.1.1
  • 锁定全部运行时、可选、开发与构建依赖,并修复 pypdf 三个安全公告
  • 新增 pydantic-settings 2.15.0 作为显式运行时依赖
  • 将未知 MCP 工具调用报告为应用错误而非成功结果

browser-use 0.13.9:恢复默认模型并修复多项稳定性问题

该版本将 bu-2-0 重新设为 ChatBrowserUse 的默认模型,mini 改为显式启用;同时修复文件系统工具、DeepSeek 默认模型、Ollama 参数位置、WebSocket 重连、Chrome 参数顺序等多项问题;将 Cloud API 文档迁移至 V4;并新增 OrcaRouter 作为命名 LLM 提供商。主要面向使用各模型适配器和云端集成的开发者,建议升级获取修复。

  • 将 bu-2-0 恢复为 ChatBrowserUse 默认模型
  • 修复文件系统、DOM、浏览器配置、模型适配器等多处问题
  • 新增 OrcaRouter 命名 LLM 提供商支持
  • 文档迁移至 Cloud API V4 并修正云浏览器价格说明

browser-use 0.13.8:模型与跨域处理全面优化

本次发布更新 Cerebras 模型 ID 与默认值,将 ChatBrowserUse 默认改为 bu-2-0-mini-preview;修复 Anthropic 工具参数解析、跨域 iframe 提取、DOM 序列化、MCP 只读工具标注等多个问题;新增 OpenClaw 技能支持,并升级多项依赖。面向开发者,建议升级。

  • ChatBrowserUse 默认模型调整为 bu-2-0-mini-preview
  • 修复跨域 iframe 提取、DOM 序列化及多项 Agent 异常处理
  • MCP 工具标注 readOnlyHint 并正确传递 isError
  • 新增 OpenClaw 技能支持并升级 aiohttp、pypdf 安全版本

browser-use 0.13.7:CLI 升级与跨域提取稳定性改进

本次发布配套 CLI 新版本,包含修复与浏览器管理改进;修复 Gemini 默认参数、React 受控输入清空、跨域 iframe 提取、选择器索引冲突等多个问题;优化 DOM 扇出边界与浏览器状态超时后的处理。面向开发者,建议升级。

  • 配套 CLI 新版本发布,改善浏览器管理
  • 修复 React 受控输入清空与跨域 iframe 提取的多处问题
  • 优化 DOM 扇出边界并避免超时后复用陈旧 DOM
  • 修复 Gemini 默认参数与 file:// 起始 URL 处理

browser-use 0.13.6:版本变化解读

browser-use 发布了 0.13.6。当前中文解读尚未完成,请以官方 Release 页面列出的变更和兼容性说明为准。

  • 官方 Release 已发布,建议打开来源核对完整变更。
  • 自动解读信息不足,升级前应重点查看兼容性与迁移说明。

browser-use 0.13.5:新增 MCP 注册表与 bu-qa-1 模型别名

本版本新增对 MCP 注册表的支持,方便按注册表方式管理外部工具;ChatBrowserUse 接受 bu-qa-1 模型别名。官方说明未提供更多细节,建议关注 MCP 集成与 QA 模型使用的用户留意升级。

  • 新增 MCP 注册表支持
  • ChatBrowserUse 接受 bu-qa-1 模型别名
  • 官方说明未提供更多细节

browser-use 0.13.4:CLI 3.0 MCP服务器与导航稳定性

该版本带来CLI 3.0的MCP服务器、共享MCP runner与max_dim守卫;修复导航就绪检测、Markdown抽取破坏URL、LLM输出截断检测、可见性检查边界突变等问题,并将Browser Harness锁定在0.1.5,含Windows可靠性修复与云浏览器建议。对使用CLI、在Windows上部署或长链路运行代理的用户建议升级。

  • CLI 3.0引入MCP服务器与共享MCP runner,新增max_dim保护
  • 新增LLM输出截断检测,可在截断时切换到兜底LLM
  • 修复Markdown抽取破坏URL以及可见性检查污染共享快照的问题

browser-use 0.13.3:发布CLI 3.0与Browser Use技能

推出由Browser Harness驱动的Browser Use CLI 3.0;新增browser-use skill命令让Claude Code、Codex、Cursor、Gemini、OpenCode等编码代理可直接安装Browser Use技能;Browser Harness固定到0.1.4并随包发布,同时改进了这些代理的技能安装行为。

  • 发布由Browser Harness驱动的CLI 3.0
  • 新增browser-use skill便于编码代理一键安装
  • 改进在Claude Code、Codex、Cursor等多个代理的技能安装行为

browser-use 0.13.2:扩展模型接入并加入发布门控

该版本在 codex 平台加入 BU3 浏览器模型,ChatBrowserUse 接受 provider-prefixed 模型 ID,发布流程增加 publish_to_pypi 环境门控,并移除 bu-3 与 bu-3-max 模型。使用代理模型与维护发布流水线的团队应关注默认值变更。

  • codex 平台新增 BU3 浏览器模型
  • ChatBrowserUse 支持 provider-prefixed 模型 ID
  • 发布流程加入环境变量门控
  • 移除 bu-3 与 bu-3-max,示例默认改为 openai/gpt-5.5

browser-use 0.13.1:支持 Claude fable 5 并修正代理工具环境变量

0.13.1 增加对 Claude fable 5 模型的支持,并在 Anthropic 通道为思考模式自动选择 tool choice,不再要求强制指定。同时修复打包代理工具时环境变量丢失的问题。影响使用 Anthropic Claude 模型或打包发布 browser-use 扩展的开发者,建议升级。

  • 新增 Claude fable 5 模型支持
  • Anthropic 通道在思考模式下自动选择 tool choice
  • 修复打包代理工具时环境变量丢失问题

COMPARISON PATH

继续对比同类方案

不要只看单页结论;沿同类用途继续比较能力边界、硬件门槛与维护状态。