尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

小红书素材采集实测:XHS-Downloader 链接提取与批量无水印下载全流程

小红书素材采集实测:XHS-Downloader 链接提取与批量无水印下载全流程 小红书素材采集实测XHS-Downloader 链接提取与批量无水印下载全流程【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具提取账号发布、收藏、点赞、专辑作品链接提取搜索结果作品、用户链接采集小红书作品信息提取小红书作品下载地址下载小红书作品文件项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader做视频剪辑和内容收集的朋友应该都体会过这种别扭小红书上看到一组高清美食图长按保存下来的全是水印和压缩噪点想留一条视频素材只能开录屏卡顿、模糊、带水印三件套一个不少。直到我试了开源的 XHS-Downloader才发现原来作品链接提取、信息采集和原画质下载可以一次全部搞定不用再跟截图和录屏较劲。这篇文章就把我从安装到批量下载的真实使用过程完整记录下来全程没有绕路。先摸清它的能力边界能干什么、不能干什么很多人一上来就想知道这工具到底多神我的建议是先看边界。XHS-Downloader 是一个面向小红书也叫 XiaoHongShu、RedNote的链接提取与作品采集工具核心能力可以归纳成四件事链接提取从账号的发布、收藏、点赞、专辑里批量提取作品链接搜索结果里的作品和用户链接也能抓信息采集把作品标题、描述、类型、下载地址等结构化信息抓下来文件下载图文、视频、livePhoto 都能下载图文支持自定义格式视频可以按清晰度偏好挑选多入口操作图形界面、命令行、API、MCP 四种方式普通用户和程序员各取所需要注意的是它需要你手动提供作品链接或者配合浏览器脚本抓取本身并不是一个输入关键词就全站抓取的爬虫。搞清楚这点后面用起来就不会有落差。装好环境五分钟看到主界面运行要求很简单Python 3.12 及以上。我用的是 uv 管理依赖比 pip 顺手不少整个流程就三步git clone https://gitcode.com/gh_mirrors/xh/XHS-Downloader cd XHS-Downloader uv sync --no-dev依赖装完后直接启动uv run main.py第一次启动会看到图形界面主界面就是一个输入框加几个按钮粘贴链接、点下载作品文件完事。底部还挂着 Q/U/S/R/M/A 几个快捷键分别对应退出、检查更新、设置、下载记录、剪贴板监听和关于页面用熟了基本不用碰鼠标。如果不想折腾环境也可以直接下载编译好的程序压缩包解压运行文件默认落在_internal\Volume\Download配置在_internal\Volume\settings.json。macOS 用户注意一个细节首次运行前要在终端执行xattr -cr 项目文件夹路径移除安全限制否则系统会拦着不让开。第一次实战一条图文加一条视频验证下载质量我没有一上来就上批量而是先拿两个作品试水——一条多图笔记和一条视频看看画质到底是不是传说中的原文件。流程非常简单复制作品链接粘贴进输入框多个链接用空格隔开点下载。程序会自动从链接里提取有效部分不需要你手动清理参数。下载完成后我特意对比了文件属性图文的尺寸、分辨率与网页原图完全一致放大看也没有二次压缩的噪点视频则是服务器端的原始文件没有平台水印。程序的工作流其实就三步——解析链接、拿到原始媒体直链、异步下载它取的是服务器源文件天然绕过了网页端加水印和压画质的环节所以画质保留是物理层面的结果不是事后修复。顺手说两个我调过的配置项video_preference支持resolution分辨率优先、bitrate码率优先、size体积优先我日常用分辨率优先image_format支持AUTO / PNG / WEBP / JPEG / HEIC要控制体积选 WEBP要做后期修图选 PNG高清视频的秘密这一步劝你别省首次测试我发现一个现象视频确实能下载但清晰度明显不是最高档。查了文档才知道不配 Cookie 时视频作品只能拿到低分辨率版本填一个 Cookie 后就能解锁高清而且不需要登录账号。获取 Cookie 的办法实测大概半分钟浏览器无痕模式打开小红书 explore 页F12 打开开发者工具切到网络标签勾选保留日志在筛选框搜web_session点开任意一条请求复制完整的 Cookie 字段粘贴进程序的 Cookie 设置如果是从浏览器读取 Cookie 有困难也可以在请求头设置里手动粘贴一份浏览器请求头User-Agent 等字段程序会用它模拟真实浏览器环境降低被风控的概率。批量场景才是真杀招让浏览器脚本替你收集链接单个作品手动复制链接完全够用但遇到把某个博主主页全存下来这种需求一个一个复制链接就太笨了。我的做法是配合 Tampermonkey 之类的脚本管理器装一个用户脚本在小红书网页端直接一键提取链接。脚本能提取的范围很实用推荐页作品、账号发布/收藏/点赞/专辑里的作品、搜索结果的链接都能抓。抓取时它会自动滚动页面把内容全部加载完默认滚动 50 次次数可以在脚本里改。抓到后直接复制粘贴到程序输入框就能批量下载。如果你嫌复制链接-粘贴这一步都多余可以把配置里的script_server设为true让程序在后台当一个小服务器网页端点一下推送下载任务脚本就把链接直接甩给程序处理全程不用碰剪贴板。命令行、API、MCP三种更程序员的用法图形界面适合日常但遇到只要某篇笔记的第 3、5、7 张图这种精确需求命令行反而更顺手# 下载指定序号的图片仅对图文作品生效 python main.py -u 作品链接 --index 1 3 5 # 指定图文输出格式为 webp python main.py -u 作品链接 --image_format webp # 一次下载多个作品链接用空格分隔、整体加引号 python main.py -u 链接1 链接2 链接3python -m source.CLI.main --help可以列出全部参数包括--folder_mode每篇单独建文件夹、--author_archive按作者分文件夹、--name_format自定义命名规则命令行的参数说明在[source/CLI/main.py](https://link.gitcode.com/i/2e3f758551744f21a548609b023ebc52)里也有完整注释。如果你的工作流需要程序化接入可以试试两种服务模式API 模式运行python main.py api访问http://127.0.0.1:5556/docs能看到自动生成的接口文档支持 POST 请求/xhs/detail传url、download、index等参数适合写脚本批量处理MCP 模式运行python main.py mcp在支持 MCP 的客户端里配置http://127.0.0.1:5556/mcp/就能用自然语言让它获取某作品的数据或下载某作品二次开发的门槛很低我自己是把 MCP 接到了日常用的对话工具里说一句把这条链接的作品信息取出来结果直接回填体验相当顺滑。数据说话我的实测结果和踩坑笔记为了写这篇体验我拿 15 篇图文加 8 条视频做了一轮对比手动保存和工具下载各跑一遍对比项手动保存XHS-Downloader15 篇图文总耗时约 35 分钟约 6 分钟视频清晰度720p 上下带水印1080p 源文件文件命名随机乱码时间 作者 标题重复下载容易存重自动跳过已下载全程动手次数每张图都要操作粘贴链接一次搞定效率差距主要在批量上单个作品其实差别不大但素材量一旦上到几十上百这个工具的价值就体现出来了。几个踩过的坑提前帮你排掉链接放久了会失效作品链接里带日期信息放太久的链接可能被风控批量下载前重新用脚本提取一遍最稳重复下载被跳过是正常现象程序默认开启下载记录download_record同一作品第二次会被跳过想强制重下去Volume/ExploreID.db里删掉对应记录就行代理工具可能添乱开着全局代理时用户脚本的下载任务可能失败遇到先关掉代理再试Linux 剪贴板要装东西xclip或xsel没装的话读取剪贴板功能不工作别把请求频率调太快程序内置了请求延时机制硬改快容易触发平台风控默认值就好收尾给同样在存素材的你用下来我的结论是如果你经常需要保存小红书内容做学习笔记、剪辑素材或个人收藏XHS-Downloader 这套浏览器脚本捞链接 程序批量下载的组合是目前我用过最省心的方案链接提取、原画质下载、格式转换、按作者归档全覆盖命令行、API、MCP 三种入口也把不同人群都照顾到了。最后说句实在话工具给的是便利不是理由。下载的内容请只用于个人学习与研究尊重原创作者的版权不要拿去商用或二次传播。工具越好用越要守住这条底线。【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具提取账号发布、收藏、点赞、专辑作品链接提取搜索结果作品、用户链接采集小红书作品信息提取小红书作品下载地址下载小红书作品文件项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表