01WHAT IT SOLVES
这个项目解决什么问题?
browser-use 定位为让大语言模型像人一样使用浏览器的开源代理库,底层基于 Playwright 等浏览器自动化能力,将自然语言任务拆解为可执行的浏览器操作序列。它提供三条使用路径:完全托管的云服务、为 Claude Code、Codex 等已有 Agent 增加浏览器能力的 CLI,以及可嵌入自有代码的 Python 库,可连接本地或云端浏览器。在同类方案中,它强调对多种主流 LLM 的兼容、灵活的工具注册机制以及对真实浏览器配置和身份认证复用的支持,官方还配套推出 BU2 专用模型与 BU Bench V2 基准测试。
02CORE CAPABILITIES
核心能力
自然语言驱动的浏览器自动化
通过自然语言指令让 Agent 自动完成网页导航、点击、填表等操作
多 LLM 兼容
支持通过 ChatBrowserUse 网关调用 Claude、GPT、Gemini、DeepSeek 等多种模型,并提供 BU2 专用模型
多种部署路径
提供托管云、CLI 和 Python 库三种方式,可连接本地或云端浏览器
自定义工具与系统提示
允许注册自定义函数工具,并可通过 extend_system_message 或 override_system_message 调整 Agent 行为
浏览器配置与认证复用
支持复用本地 Chrome 配置文件,或通过云浏览器同步 Cookie 进行身份认证
03适合谁
- 需要为 LLM Agent 赋予浏览器操作能力的应用开发者
- 希望用自然语言自动化网页流程的 Python 工程师
- 使用 Claude Code、Codex 等已有 Agent 并希望扩展浏览器能力的团队
- 研究浏览器 Agent 性能与基准的科研人员
04典型使用场景
- 自动登录并抓取需要认证的网页数据
- 通过 CLI 给 Claude Code、Codex 等 Agent 赋予浏览器操作能力
- 自动化表单填写、预约、购票等多步交互网页任务
- 在自有 Python 应用中嵌入浏览器 Agent 处理动态网页内容
05为什么值得关注
- 社区关注度高,GitHub Star 数已超过十万
- 提供 BU2 专用模型与 BU Bench V2 基准测试,便于评估浏览器 Agent 能力
- 支持本地与云端浏览器两种模式,兼顾隐私与规模化
- 与 Playwright 等主流浏览器自动化底层深度集成
06采用前要注意
- 本地模型推理和托管浏览器需自行配置 API 密钥或硬件资源
- 验证码与反爬机制不能保证完全规避
- 配置文件同步仅传输 Cookie,不包含 localStorage、IndexedDB 或扩展
- 依赖 Python 3.11 及以上版本
07RELEASE INTELLIGENCE
近期版本变化
browser-use 0.13.10:依赖全面固定并修复安全公告
本次升级将 Browser Harness 提升至 0.1.13,并对全部运行时、可选、开发与构建依赖进行精确锁定;迁移至 MCP Python SDK 2.1.1,新增 pydantic-settings 为显式运行时依赖,修复 pypdf 的三个 Dependabot 安全公告;同时将未知 MCP 工具调用改为报告为应用错误而非成功结果。影响所有集成该库的用户,建议关注依赖固定带来的兼容性与安全修复。
- 升级 Browser Harness 至 0.1.13 并迁移到 MCP Python SDK 2.1.1
- 锁定全部运行时、可选、开发与构建依赖,并修复 pypdf 三个安全公告
- 新增 pydantic-settings 2.15.0 作为显式运行时依赖
- 将未知 MCP 工具调用报告为应用错误而非成功结果
browser-use 0.13.9:恢复默认模型并修复多项稳定性问题
该版本将 bu-2-0 重新设为 ChatBrowserUse 的默认模型,mini 改为显式启用;同时修复文件系统工具、DeepSeek 默认模型、Ollama 参数位置、WebSocket 重连、Chrome 参数顺序等多项问题;将 Cloud API 文档迁移至 V4;并新增 OrcaRouter 作为命名 LLM 提供商。主要面向使用各模型适配器和云端集成的开发者,建议升级获取修复。
- 将 bu-2-0 恢复为 ChatBrowserUse 默认模型
- 修复文件系统、DOM、浏览器配置、模型适配器等多处问题
- 新增 OrcaRouter 命名 LLM 提供商支持
- 文档迁移至 Cloud API V4 并修正云浏览器价格说明
browser-use 0.13.8:模型与跨域处理全面优化
本次发布更新 Cerebras 模型 ID 与默认值,将 ChatBrowserUse 默认改为 bu-2-0-mini-preview;修复 Anthropic 工具参数解析、跨域 iframe 提取、DOM 序列化、MCP 只读工具标注等多个问题;新增 OpenClaw 技能支持,并升级多项依赖。面向开发者,建议升级。
- ChatBrowserUse 默认模型调整为 bu-2-0-mini-preview
- 修复跨域 iframe 提取、DOM 序列化及多项 Agent 异常处理
- MCP 工具标注 readOnlyHint 并正确传递 isError
- 新增 OpenClaw 技能支持并升级 aiohttp、pypdf 安全版本
browser-use 0.13.7:CLI 升级与跨域提取稳定性改进
本次发布配套 CLI 新版本,包含修复与浏览器管理改进;修复 Gemini 默认参数、React 受控输入清空、跨域 iframe 提取、选择器索引冲突等多个问题;优化 DOM 扇出边界与浏览器状态超时后的处理。面向开发者,建议升级。
- 配套 CLI 新版本发布,改善浏览器管理
- 修复 React 受控输入清空与跨域 iframe 提取的多处问题
- 优化 DOM 扇出边界并避免超时后复用陈旧 DOM
- 修复 Gemini 默认参数与 file:// 起始 URL 处理
browser-use 0.13.6:版本变化解读
browser-use 发布了 0.13.6。当前中文解读尚未完成,请以官方 Release 页面列出的变更和兼容性说明为准。
- 官方 Release 已发布,建议打开来源核对完整变更。
- 自动解读信息不足,升级前应重点查看兼容性与迁移说明。
browser-use 0.13.5:新增 MCP 注册表与 bu-qa-1 模型别名
本版本新增对 MCP 注册表的支持,方便按注册表方式管理外部工具;ChatBrowserUse 接受 bu-qa-1 模型别名。官方说明未提供更多细节,建议关注 MCP 集成与 QA 模型使用的用户留意升级。
- 新增 MCP 注册表支持
- ChatBrowserUse 接受 bu-qa-1 模型别名
- 官方说明未提供更多细节
browser-use 0.13.4:CLI 3.0 MCP服务器与导航稳定性
该版本带来CLI 3.0的MCP服务器、共享MCP runner与max_dim守卫;修复导航就绪检测、Markdown抽取破坏URL、LLM输出截断检测、可见性检查边界突变等问题,并将Browser Harness锁定在0.1.5,含Windows可靠性修复与云浏览器建议。对使用CLI、在Windows上部署或长链路运行代理的用户建议升级。
- CLI 3.0引入MCP服务器与共享MCP runner,新增max_dim保护
- 新增LLM输出截断检测,可在截断时切换到兜底LLM
- 修复Markdown抽取破坏URL以及可见性检查污染共享快照的问题
browser-use 0.13.3:发布CLI 3.0与Browser Use技能
推出由Browser Harness驱动的Browser Use CLI 3.0;新增browser-use skill命令让Claude Code、Codex、Cursor、Gemini、OpenCode等编码代理可直接安装Browser Use技能;Browser Harness固定到0.1.4并随包发布,同时改进了这些代理的技能安装行为。
- 发布由Browser Harness驱动的CLI 3.0
- 新增browser-use skill便于编码代理一键安装
- 改进在Claude Code、Codex、Cursor等多个代理的技能安装行为
browser-use 0.13.2:扩展模型接入并加入发布门控
该版本在 codex 平台加入 BU3 浏览器模型,ChatBrowserUse 接受 provider-prefixed 模型 ID,发布流程增加 publish_to_pypi 环境门控,并移除 bu-3 与 bu-3-max 模型。使用代理模型与维护发布流水线的团队应关注默认值变更。
- codex 平台新增 BU3 浏览器模型
- ChatBrowserUse 支持 provider-prefixed 模型 ID
- 发布流程加入环境变量门控
- 移除 bu-3 与 bu-3-max,示例默认改为 openai/gpt-5.5
browser-use 0.13.1:支持 Claude fable 5 并修正代理工具环境变量
0.13.1 增加对 Claude fable 5 模型的支持,并在 Anthropic 通道为思考模式自动选择 tool choice,不再要求强制指定。同时修复打包代理工具时环境变量丢失的问题。影响使用 Anthropic Claude 模型或打包发布 browser-use 扩展的开发者,建议升级。
- 新增 Claude fable 5 模型支持
- Anthropic 通道在思考模式下自动选择 tool choice
- 修复打包代理工具时环境变量丢失问题
COMPARISON PATH
继续对比同类方案
不要只看单页结论;沿同类用途继续比较能力边界、硬件门槛与维护状态。