
browser-use用一句话驱动 AI 完成网页自动化的 5 分钟上手【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use给 AI 一句去招聘网站搜索前端工程师职位把前 10 条的标题、公司、薪资提取出来存成 CSV它打开真实浏览器进入搜索页滚动列表逐条点进详情页核对薪资最后落盘一份带表头的 CSV。从任务输入到文件生成约 1 分钟。browser-use 是一个开源的 AI 驱动网页自动化框架让大模型像人一样点击、输入、滚动、下载。一句话任务怎么变成一串浏览器操作它的价值不在又能自动点什么而在一条清晰的链路输入是一句话任务和一个 LLM内部由 browser_use/agent/ 负责规划与决策、browser_use/browser/ 维持真实浏览器会话、browser_use/dom/ 把页面 DOM 序列化成模型看得懂的文本三者循环执行感知页面 → 模型决策 → 执行动作 → 再次感知直到任务完成或达到失败上限输出操作历史与结构化结果。选哪个模型直接影响成功率下图是官方在 100 个真实浏览器任务上的对比模型越强、任务越复杂差距越明显选型时先看这张图。5 分钟跑通第一个自动化任务装包并把任意一家 LLM 的 API key 放进.envpip install browser-use然后写一个 5 行的入口脚本import asyncio from browser_use import Agent, ChatBrowserUse async def main(): agent Agent( task在 Google 搜索 what is browser automation汇报前 3 条结果, llmChatBrowserUse(modelbu-2-0-mini-preview), ) history await agent.run() print(history.final_result()) asyncio.run(main())运行后你会看到一个真实浏览器窗口自动打开终端逐条打印每一步动作比如click 12input 姓名。搜索加提取这类任务通常一两分钟结束中途点错元素时它会自己回退重试不用人工盯着。三个任务写法的递进逻辑任务难度递进时改的不是代码而是任务字符串。轻量单句查询。只交代目标和验收点路径让模型自己规划搜索 best Python web scraping libraries打开一篇靠谱的文章告诉我推荐的 3 个库。中等跨页提取。把站点、字段、格式三件事说死输出才稳定访问 quotes.toscrape.com提取前 5 条名言的文本、作者和标签按引言 - 作者 - 标签逐行列出。字段和格式明确后结果可以直接接下游脚本。复杂多步长流程。用编号把步骤排出来并指定终点交付物研究 Python 爬虫库1. 搜索 2024 主流库2. 挑出口碑最好的 3 个3. 逐个访问官网提取名称、特点、GitHub star 数4. 输出对比总结。编号让模型按序执行不跳步终点交付物让完成有客观标准。examples/getting_started/ 目录里这四个样例按同一递进顺序编写可对照着改。三个最实用的配置项调参与定制先碰这三个就够。模型偶发超时、限流时给 Agent 加fallback_llm配一个便宜的备用模型主模型连续失败会自动降级任务不断档批量跑时尤其需要。涉及密码、token 时把凭据放进sensitive_data字典任务里只引用占位符实际值在执行动作时注入、不进模型上下文防止明文泄密agent Agent( task用 {{username}} 和 {{password}} 登录内网后台, llmllm, sensitive_data{username: me, password: secret}, )要控制浏览器行为时用browser_profile传user_data_dir、proxy、headless、language等参数下载目录和代理都在这一个对象里配置不用散落各处。四个高频问题的现象与解法任务卡死不动通常是模型在重复点击同一元素形成死循环把max_failures调低并限制总步数让它更快失败退出。登录态每次丢失默认使用临时浏览器数据目录在 profile 里固定user_data_dir并保存 storage_state之后复用同一目录即可保持登录。页面元素定位不准、漏点开启use_visionTrue让模型看截图辅助判断对弹窗、浮层这类场景准确率明显提升。长任务在慢网络上频繁中断step_timeout默认 180 秒重型页面容易不够把它和llm_timeout一起调大减少假死误判。把任务换成你自己的网站回看开头那个招聘网站的任务把任务字符串里的网站和字段换成你自己的比如去官网查版本历史导出 CSV剩下的交给那个自动打开的浏览器窗口。【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考