尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

Browser-Use 实战指南:一句话完成网页任务,10 分钟跑通 AI 浏览器自动化

Browser-Use 实战指南:一句话完成网页任务,10 分钟跑通 AI 浏览器自动化 Browser-Use 实战指南一句话完成网页任务10 分钟跑通 AI 浏览器自动化【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use以前 30 分钟的手工网页流程现在一句话就能跑完。Browser-Use 是一个 AI 浏览器自动化框架你用自然语言描述任务它打开真实浏览器替你点击、输入、滚动、下载。本文带你装好环境、跑通第一个任务并把常用配置一次讲清。项目定位AI 浏览器自动化框架Browser-Use 是一个让 AI 替你操作真实浏览器的开源框架。自然语言描述浏览器替你操作任意主流大模型可接入当大脑本地、云端均可运行五分钟上手安装与第一个任务pip install browser-use # 把大模型密钥写入 .env例如 BROWSER_USE_API_KEY你的密钥import asyncio from browser_use import Agent, ChatBrowserUse async def main(): agent Agent( task查找 browser-use 项目在 GitHub 上的星标数, llmChatBrowserUse(modelopenai/gpt-5.5), ) await agent.run() asyncio.run(main())运行后你会看到一个浏览器窗口自己打开导航到项目页面读出星标数字最后把执行历史打印出来。就这么简单。核心能力拆解填表、抓数据、加本事批量填写表单场景几十份结构相同、只有姓名和职位不同的入职申请。做法任务写登录招聘系统为张三前端开发、李四后端开发填写申请表确认必填项正确后提交并截图留档。效果它逐份导航、逐格填写、逐项核对提交后自己截图存档你只验收结果。结构化数据抓取场景三个电商平台的价格每天要记一遍。做法任务写访问京东、天猫、拼多多记录 iPhone 的当前售价和评价数量整理成 CSV列为商品名、价格、评价数。效果它自动翻页定位商品把数据落成一份可直接打开的 CSV 文件。仓库里还有个演示应用让 AI 抓取官网信息后生成广告图和落地页注册自定义工具内置动作不够时你可以把自己的 Python 函数注册成工具。写一个函数用tools.action(description...)标记再把toolstools传给 AgentAI 就会在需要时主动调用它而不是自己心算。完整用法见 tools/ 目录现成示例在 examples/custom-functions/。实战走一遍跨平台比价任务Step 1把最小脚本里的 task 换成访问京东、天猫、拼多多记录 iPhone 15 的当前售价和评价数量整理成 CSV 文件列包含商品名、价格、评价数。Step 2运行python main.py观察浏览器逐站打开、读取价格等待结束。Step 3检查项目目录下生成的 CSV 文件核对三个平台的数据是否齐全缺了就重跑该步。把 Step 1 里的平台换成你自己的站点清单、列名换成你报表需要的字段就能适配你的日常比价或巡检场景。需要登录的站点参考 examples/browser/ 里的真实浏览器配置复用你已登录的 Chrome 配置文件。进阶配置三个最见效的旋钮max_steps— Agent 的步数上限防止任务在页面上打转死循环 — 给所有任务兜底。headless— 在 browser_use/browser/profile.py 中设为 True浏览器不弹窗 — 服务器环境跑定时任务。downloads_path— 指定文件下载目录不用每次翻系统临时目录 — 批量下载报表的场景。另外proxy支持配置代理服务器跑敏感站点时可以换出口 IP降低被限流的概率。模型怎么选一张图看成功率官方基准在 100 个真实浏览器任务上测得官方云端 Agent 成功率 85%开源库搭配不同模型在 31%74% 之间。性能优先官方优化模型官方 FAQ 称完成速度快 35 倍预算有限GPT-5.5、Gemini Flash 这类通用模型成功率 65% 上下复杂任务Claude Opus 4.7开源配置里 74% 最高本地部署接 Ollama 跑本地模型数据不出内网避坑清单⚠️ 稳定性任务描述写清可验证的完成标准给任务设max_steps上限防死循环。⚠️ 安全API 密钥只放.env别写进代码敏感站点的账号密码复用浏览器配置或同步存储状态不明文传给模型。性能并发 Agent 别贪多每个都占浏览器内存大站点任务优先关掉图片加载提速。社区与生态仓库已拿下 6.9 万 star官方里程碑图如下官方在 200 个长程网页任务的 Odysseys 基准上拿到 87.4% 平均分测试目录覆盖安全、交互、序列化等 60 多个测试文件迭代节奏快。高频问题快答它免费吗开源部分 MIT 协议免费。你只为所用大模型的 API 调用付费本地模型连这部分也省了。支持哪些浏览器基于 Chromium 内核Chrome、Edge 等现代浏览器都能驱动。需要登录的网站怎么办参考 examples/browser/ 的例子复用你已登录的真实 Chrome 配置或保存会话状态后自动保持登录。遇到验证码怎么办官方建议用配套云端浏览器自带隐身指纹和代理轮换来应对检测。该用 CLI 还是 Python 库一次性任务交给 CLI要在代码里做可重复的自动化用 Python 库。收尾打开终端跑通你的第一个网页自动化任务。参考README.md · 示例 examples/ · 源码 browser_use/ · 能力速查 skills/【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表