尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

XHS-Downloader 小红书下载工具实战:3 步从收藏链接到本地整理好的文件

XHS-Downloader 小红书下载工具实战:3 步从收藏链接到本地整理好的文件 XHS-Downloader 小红书下载工具实战3 步从收藏链接到本地整理好的文件【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader收藏夹里堆了两百条笔记想存到本地就得逐条右键另存图片存下来是 HEIC 格式打不开视频下载回来只有标清。XHS-Downloader 是一个开源的小红书下载工具把链接 → 作品信息 → 文件整条链路自动化。读完这篇你能在 10 分钟内下完第一个作品并知道该在什么时候用它的哪一层能力。这个小红书下载工具到底帮你省了什么一句话概括它的核心价值让链接 → 信息 → 文件这条链路上的每一步都不用你手动操作。拆开看是三件事收链接账号的发布、收藏、点赞、专辑作品搜索结果和推荐页的作品都能一键批量提取结果直接进剪贴板不用逐条复制。取信息拿到链接后自动解析标题、作者、发布时间、互动数据以及图片和视频的真实下载地址。落文件按你设定的格式下载图片和视频支持断点续传、自动跳过已下载的作品、按作者建文件夹归档。能力边界也说清楚它只负责可见即可得的采集与存储不做内容编辑、不转码、没有任何破解功能页面里看不到的东西它也拿不到。跑通第一个完整流程10 分钟下完第一个作品这是 XHS-Downloader 怎么安装、然后立刻看到结果的一节。走源码运行需要 Python 3.12 或更高版本git clone https://gitcode.com/gh_mirrors/xh/XHS-Downloader cd XHS-Downloader pip install -r requirements.txt # 安装依赖 python main.py # 启动程序习惯uv的话把后两条换成uv sync --no-dev和uv run main.py即可Docker 用户直接拉取joeanamier/xhs-downloader镜像起容器效果一样。启动后进入 TUI 界面——长得像图形软件、操作全靠键盘。主界面正中是个输入框把作品链接粘进去多个链接用空格隔开程序会自动清洗出有效链接然后按提示执行下载作品文件。它认四种链接写法https://www.xiaohongshu.com/explore/作品ID?xsec_tokenXXXhttps://www.xiaohongshu.com/discovery/item/作品ID?xsec_tokenXXXhttps://www.xiaohongshu.com/user/profile/作者ID/作品ID?xsec_tokenXXXhttps://xhslink.com/分享码短链直接粘看到你下完了的锚点文件落在Volume/Download文件夹里文件名默认是发布时间 作者昵称 作品标题。界面底部还有三个快捷键值得记S进设置、R看下载记录、M开启剪贴板监听——开启后你在任何地方复制一条小红书链接程序自动开下连粘贴都省了。三种用法离工具多远取决于你的需求下一节回答下什么、怎么下。按你和工具的交互距离分三层用哪层看频率偶尔存几张图用第一层批量任务用第二层做对接用第三层。离工具最近在浏览器里直接用项目自带一个 Tampermonkey 用户脚本源码在static/XHS-Downloader.js。装法浏览器装好 Tampermonkey 扩展 → 新建脚本 → 把该文件内容整段粘进去保存 → 刷新小红书页面侧边就多出功能菜单。菜单能干的事比想象的多提取账号发布 / 收藏 / 点赞 / 专辑的作品链接、提取搜索结果的作品与用户链接、提取推荐页作品链接以及一键推送下载任务给本地主程序。提取结果自动写入剪贴板等于你逛一圈页面几十上百条链接已经躺在剪贴板里了。一个细节要提醒脚本默认不自动滚动页面需要你手动往下滑加载更多再提取。设置里可以打开自动滚动但官方明确说过开启后可能被平台判定为自动化操作有账号风控风险。我的建议是批量提取这种低频操作手动滚一滚最稳妥。想更进一步可以开联动在Volume/settings.json里把script_server设为true保持主程序后台运行浏览器菜单点推送下载任务链接直接送到主程序下载全程不切窗口。这一层适合刷着刷着顺手囤素材的日常场景。离工具中等用一条命令跑批需求明确的一批作品走命令行模式CLI效率最高主程序的所有设置都变成了命令参数python main.py --help能看全。三个最高频的组合# 单条下载 python main.py --url https://www.xiaohongshu.com/explore/作品ID?xsec_tokenXXX # 多条一起下空格分隔整体加引号 python main.py --url 链接1 链接2 链接3 # 只下图文作品的第 1、3、5 张图 python main.py --url https://www.xiaohongshu.com/explore/作品ID?xsec_tokenXXX --index 1 3 5其他常用的还有--image_format JPEG指定图片格式、--folder_mode每个作品独立文件夹、--author_archive按作者归档、--cookie ...临时指定 Cookie不改配置文件。对脚本爱好者最友好的参数是--update_settings在命令行里试各种组合试到顺手的那次加一个--update_settings参数就被写回Volume/settings.json之后所有模式都沿用这套设置。调参过程因此变成了可复现的命令而不是在 JSON 里盲改。这一层适合每周都要整理某个固定来源的重复性流程把命令写进脚本或定时任务就行。离工具最远让别的程序和 AI 调它前两层是人指挥机器这层反过来让别的程序来指挥它适合做内容运营、写自动化脚本、搭 AI 工作流的人。启动 API 模式只需一条命令python main.py api # 服务跑在 http://127.0.0.1:5556浏览器打开http://127.0.0.1:5556/docs就是自动生成的交互式文档。核心接口是POST /xhs/detail最简调用长这样import httpx # 传作品链接downloadTrue 时解析完直接下载文件 resp httpx.post( http://127.0.0.1:5556/xhs/detail, json{ url: https://www.xiaohongshu.com/explore/作品ID?xsec_tokenXXX, download: True, # 是否同时下载文件 index: [1, 3, 5], # 只下这几张图仅图文作品生效 }, timeout60, ) print(resp.json())cookie和proxy参数缺省时自动沿用配置文件里的值接入成本很低。微信公众号机器人、定时任务都能直接复用这套采集能力。MCP 模式则是给 AI 助手准备的python main.py mcp启动后在支持 MCP 的客户端里配一个 Streamable HTTP 服务地址填http://127.0.0.1:5556/mcp/之后在对话框里说帮我把这个链接的图文下载下来只要第 1、3、5 张AI 就替你完成了。这套能力的意义下载不再是孤立操作而是可以嵌进任何工作流里的零件。让它长成你自己的样子配置文件里值得动的 7 个参数工具趁不趁手一半在参数。所有模式的参数最终都汇总到Volume/settings.json首次运行自动生成不想碰 JSON 就在 TUI 主界面按S进设置界面效果一样。改完重启程序才生效没有热加载。挑 7 个不读说明就不知道的参数参数默认值什么情况下该改它image_formatJPEG想要接近原图质量就设AUTO跟随服务器返回格式拿不到 HEIC 的版本会自动降级为 WEBPname_format发布时间 作者昵称 作品标题想换归档习惯时可换入点赞数量、作品ID、作品类型等字段空格分隔folder_modefalse作品文件多、想每个作品单独一个文件夹时开启author_archivefalse长期追更某几个博主按作者建文件夹时开启download_recordtrue文件被误删想重下、又懒得清数据库记录时临时关掉write_mtimefalse想让文件修改时间等于作品发布时间、方便按时间排序时开启cookie空视频想要高画质时必配见下节排错非登录状态即可 其中author_archive有个进阶玩法配合mapping_data参数给作者设别名格式作者ID: 别名归档文件夹就用你起的别名而不是作者 ID——追更博主、整理竞品素材时很好用。作者改昵称时程序还会自动同步更新已下载文件里的昵称部分。高频翻车点为什么下载回来的视频只有标清没配 Cookie。未配置时视频作品只能拿到低分辨率版本。解法不需要登录账号浏览器打开小红书任意页面按 F12 打开开发者工具在网络面板过滤cookie-name:web_session从任意请求里复制完整 Cookie 填进配置即可。为什么明明没下载过程序却直接跳过了大概率是下载记录在作祟。默认情况下程序把下载成功的作品 ID 存在Volume/ExploreID.db记录里有这个 ID 就跳过即使文件已经被你删了。想重下就删掉数据库里对应的记录或者把download_record关掉程序会改为检查文件是否存在。为什么链接经常报错、请求失败两个常见原因作品链接携带日期信息用很久之前提取的链接可能触发风控尽量用最新提取的链接其次是网络问题把配置里的max_retry重试次数和timeout超时秒数调大网络特殊再设proxy代理。先动这三个参数比反复重启程序有效得多。三层用法不是替代关系按使用频率组合即可日常刷小红书囤素材用浏览器脚本圈链接 TUI 粘贴下载重复性的固定流程把 CLI 命令写进脚本要对接自己的程序或 AI再起 API 或 MCP 服务。给你一个这周就能执行的小计划① 今天跑通最小流程下 5 个作品确认文件落在Volume/Download② 明后打开设置界面把image_format、folder_mode、author_archive按自己的归档习惯调一遍③ 挑一个重复场景比如每周整理某个博主的更新用 CLI 试出顺手参数后加--update_settings固化下来。想深入的话项目根目录的README.md是完整中文说明example.py里XHS类的调用示例是二次开发的起点Docker 用户则直接记住joeanamier/xhs-downloader这个镜像名就行。【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表