Browser-Use 快速上手:AI 浏览器自动化 Browser-Use 快速上手AI 浏览器自动化【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use周一早上 8:15你打开第五个后台系统准备导出上周的报表——同样的动作你已经重复了几百次。browser-use 是一个开源的 AI 浏览器自动化框架你用一句自然语言描述任务它就驱动真实浏览器替你点完、填完、下完不用写一行操作代码。它到底能替你做什么我最近用它把每周半天的重复活压成一句话。它会像人一样看页面、点按钮、填表单、滚动加载接入任意主流大模型当它的大脑本地或云端都能跑数据留在自己手里。对做运营、测试、运维的同事来说这类碎而重复的网页活正是它的舒适区。 10 分钟跑通第一个任务先克隆仓库并安装依赖三条命令搞定环境git clone https://gitcode.com/GitHub_Trending/br/browser-use cd browser-use pip install browser-use在.env里写入大模型密钥例如BROWSER_USE_API_KEY你的密钥也可以用 OpenAI、Google 的密钥。下面这个最小示例让 AI 去真实网页上查一个数据并返回答案import asyncio from browser_use import Agent, ChatBrowserUse async def main(): agent Agent( task查找 browser-use 项目在 GitHub 上的星标数, llmChatBrowserUse(modelopenai/gpt-5.5), ) history await agent.run() print(history) asyncio.run(main())运行后会看到浏览器窗口自己打开、导航、读数、把结果打印出来。之后你只需要改 task 那一行换成自己的任务描述。我的场景它能覆盖吗它接收的是任务描述而不是代码。三种典型用法照抄改写即可场景任务描述预期产出多平台比价分别打开京东、天猫、拼多多记录 iPhone 15 的当前售价与评价数整理成 CSV含商品名、价格、评价数的 CSV 文件批量入职申请登录招聘系统为张三前端开发、李四后端开发各填一份申请表必填项核对无误后提交并截图两份已提交的申请 提交页截图站点巡检每小时检查官网首页返回 404、加载超 10 秒或出现报错页就向运维群发通知带时间戳的检查日志 异常告警更重的活也能接仓库里的演示应用让 AI 抓取官网信息后生成广告图和落地页效果见下图。 调教成你的专属工具先加本事。注册一个自定义工具AI 执行任务时会在需要时自动调用它from browser_use import Agent, Tools tools Tools() # 注册自定义动作description 写得越清楚AI 越会用对 tools.action(description计算两个数字的和) def add_numbers(a: int, b: int) - int: return a b # 把 tools 传给 Agent 即生效 agent Agent(task..., llmyour_llm, toolstools)再调参数。浏览器行为集中在 browser_use/browser/profile.py 里调代理、下载路径、页面加载超时、是否禁用图片加载等都有独立配置项。再挂钩子。它的事件系统event system即事件发生时触发回调的机制允许你在页面加载、弹窗出现、下载完成这些时机挂上自己的逻辑比如下载一完成就自动改名归档。大模型怎么选同一个任务换模型成功率差别不小。下面是官方基准测试的对比三档选型各附理由性能优先用官方优化模型基准成功率约 85%。因为它针对 browser-use 的动作输出格式专门调优过工具调用和页面理解明显更稳。预算有限GPT-5.5、Gemini Flash 这类通用模型成功率 65% 上下。调用成本低很多适合大批量、可容忍重试的任务。数据敏感接 Ollama 跑本地模型。数据不出内网适合金融、政务等不能外发信息的业务。⚠️ 跑之前先看这三件事稳定性。任务跑了 200 步还在循环点确定多半是描述里缺了可验证的完成标准。把成功长什么样写进 task用最大步数参数给任务兜底网络类错误配置重试而不是直接失败。安全。密钥被不小心提交进仓库的事故并不罕见。API 密钥只放环境变量敏感站点的账号密码走 2FA 集成不要明文塞给模型能收窄的访问域名范围就收窄。性能。并发开了 8 个 Agent机器先卡死了——每个 Agent 都占一份浏览器内存3 个以内先跑顺再加大站点任务优先关掉图片加载页面轻快不少。社区层面项目已积累 6.9 万星说明这套方案被大量真实场景验证过几个高频问题完全免费吗框架本身开源免费MIT 协议。你只为所用大模型的 API 调用付费本地部署则连这部分也省了。不会写代码行不行行。最小示例只有十几行照抄再改任务描述就能上手复杂场景参考 examples/ 里的现成脚本。支持哪些浏览器基于 Chromium 内核Chrome、Edge 等现代浏览器都没问题。需要登录的网站怎么办支持保存 Cookie 和会话状态首次登录后状态会保留后续任务自动保持登录。会被网站发现吗它内置拟人操作和随机延迟来降低检测风险。高安全级别的站点建议先小规模试跑再考虑放量。支持中文网站吗完全支持中英文页面都能处理任务描述直接用中文写就行。下一步做什么今天装好环境跑通上面查星标的最小任务10 分钟内完成。这周从示例里挑一个最像你日常工作的改掉任务描述跑起来。长期给自己最高频的任务加一个自定义工具或接入本地模型彻底摆脱 API 依赖。常用资源集中在这一处完整文档 README.md、各场景示例 examples/、边界情况测试 tests/、能力速查 skills/。现在就打开终端跑通你的第一个任务。【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考