尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

Browser-Use 零代码网页数据提取:四步从任意页面拿到 JSON

Browser-Use 零代码网页数据提取:四步从任意页面拿到 JSON Browser-Use 零代码网页数据提取四步从任意页面拿到 JSON【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use用 Browser-Use 不写代码就能把网页内容变成 JSON 或 CSV。它的做法很直接模拟人类操作浏览器打开页面、识别元素再按你定义的格式把页面信息整理成结构化数据。它是怎么干活的整条链路分三步。第一步它按你的任务描述打开浏览器访问目标网址完成必要的点击、滚动和输入第二步它把页面上所有可交互元素按钮、输入框、列表项、链接识别出来标上位置第三步它读取页面内容按你声明的字段和结构输出直接得到 JSON 或 CSV 文件。全程不需要你写 CSS 选择器、抓包脚本或任何解析代码。从克隆到第一次提取先克隆仓库git clone https://gitcode.com/GitHub_Trending/br/browser-use按 README 装好依赖用 Python 3.12执行uv pip install browser-use或者直接用pip install browser-use浏览器环境它会自动帮你配好。指定目标 URL 和提取要求用一句话描述即可例如打开苹果 iPhone 16 Pro 产品页提取商品名和价格不需要写脚本。执行结束后结果以结构化 JSON 或 CSV 返回字段按你声明的格式组织可以直接写进表格或数据库。提取格式由你定不指定格式时提取结果是一段自然语言摘要你声明了输出结构它就严格按结构返回。声明方式是在任务上挂一个 Pydantic 模型类作为output_model_schema类里写哪些字段结果就是哪些字段。举两个例子声明name商品名和price价格两个字段访问电商详情页得到{name: iPhone 16 Pro, price: From $999 or $41.63/mo.}声明一个列表字段访问商品列表页它就按条目返回数组每条都是同一套字段。字段类型字符串、数字、列表、可选都可以声明类型对不上时结果会被校验拦住。执行完用history.structured_output就能拿到解析好的对象不用再自己拆文本。结构化输出的完整用法和字段声明细节见 Agent 文档的结构化输出章节。动态页面与常见卡点等页面加载完再提取。列表、懒加载内容常在首次渲染后才出现任务里写明等待条件比如等商品卡片出现比固定睡几秒可靠。用更精确的指代定位元素。页面上多个元素长得像比如一排价格、一排购买按钮时直接按文本或相对位置描述目标第二个价格比那个价格少出很多错。看执行日志和界面截图定位问题。每一步操作都有日志和对应截图提取结果不对时对照截图看是哪一步点错了位置、读错了节点改任务描述重跑即可。换个模型再试。同一任务在不同模型上的成功率差距很大卡住时换更强的模型比反复调描述更快。这些场景能直接用电商比价跑一圈多个详情页按商品名、价格、规格三个字段导出 CSV直接横向对比。资讯聚合定期访问新闻列表页提取标题、作者、发布时间汇总进自己的数据源。表单信息整理按模板填完表单后回读字段输出结构化数据存档。挑一个你天天要抄数的页面定义三个字段跑第一次提取。【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表