尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

小红书无水印下载实测:XHS-Downloader 把 40 分钟手工存档压缩到 5 分钟

小红书无水印下载实测:XHS-Downloader 把 40 分钟手工存档压缩到 5 分钟 小红书无水印下载实测XHS-Downloader 把 40 分钟手工存档压缩到 5 分钟【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具提取账号发布、收藏、点赞、专辑作品链接提取搜索结果作品、用户链接采集小红书作品信息提取小红书作品下载地址下载小红书作品文件项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader上半年我接了个整理素材库的活儿把一个账号近 200 篇小红书图文和视频存成本地资料要求无水印、原画质、按作者分文件夹。第一天我用最原始的办法——长按保存、录屏、手动改文件名忙到晚上十点才弄完三十几篇放大一看全是压缩噪点根本没法做二次加工。换成开源工具 XHS-Downloader 之后同样一批内容 5 分钟跑完落地的都是干净的源文件。这篇实测不讲源码只聊它怎么装、怎么配、批量下载时哪些坑我已经替你踩过了。先看它能接住哪些活XHS-Downloader 的项目定位一句话能说清小红书链接提取/作品采集工具。展开看能力大致分四块提取链接账号发布、收藏、点赞、专辑里的作品链接搜索结果里的作品链接和用户链接推荐页链接采集信息把作品的标题、描述、类型、作者等结构化信息抓下来存文件提取地址拿到作品的原始下载地址下载文件图文、视频、livePhoto 按无水印原画质保存图片格式可选。它支持的链接形态也全explore 页、discovery/item、user/profile、xhslink.com 短链都能解析一次可以输入多个链接用空格分隔程序会自动提取有效部分不用自己清洗。动手之前我先把三种打开方式理清楚免得后面绕路打开方式适合场景上手难度我的用法图形界面TUI零散下载、日常捡漏最低复制链接→粘贴→回车命令行CLI精准控制、批量脚本化中指定下载某几张图、指定输出格式用户脚本程序作者主页全量存档中脚本捞链接→程序批量下载一句话总结定位单篇靠界面精准靠命令行批量靠用户脚本。三步把它跑起来环境要求只有一条Python 3.12 及以上。我没用打包好的可执行文件走的是源码启动三步走git clone https://gitcode.com/gh_mirrors/xh/XHS-Downloader cd XHS-Downloader uv sync依赖同步完直接启动uv run main.py机器上没有 uv 的话用 pip 也一样python -m venv venv venv/Scripts/activate # Windows source venv/bin/activate # macOS / Linux pip install -r requirements.txt python main.py第一次启动会在项目根目录生成settings.json每个配置项都带说明。我开局就改了两处name_format保持默认的“发布时间 作者昵称 作品标题”文件名的信息量直接拉满author_archive设为true按作者分文件夹归档时不用再手动整理。启动阶段有两个小坑顺手记下来想省事可以直接用 Releases 里的打包版解压即用文件默认存_internal\Volume\Download配置在_internal\Volume\settings.jsonmacOS 首次运行前要在终端执行xattr -cr 项目文件夹路径否则系统安全限制会拦着不让开。程序默认开启下载记录同一作品第二次会被静默跳过——这是防重复的设计不是 bug别慌。从“能用”到“好用”四个关键操作图形界面粘贴链接就完事程序启动后就是交互式图形界面。把链接粘进输入框点“下载无水印作品文件”就完事它还支持读取剪贴板、查看下载记录快捷键 Q 退出、S 进设置。日常零散捡漏我基本只碰这里。命令行只下第 3、5、7 张图当需求变成“只要某篇图文笔记的第 3、5、7 张图”时界面就笨拙了命令行最精准python main.py -u 作品链接 -i 3 5 7几个常用参数记一下-i只对图文作品生效多个序号用空格分隔-if指定图片输出格式命令行支持 PNG、WEBP-fm每篇作品单独建文件夹-aa按作者归档-nf自定义文件命名规则-bc Chrome直接从浏览器读取 Cookie 写入配置Windows 需要管理员权限全部参数可用python main.py --help一次看全截图就是参数总表。这里有个细节容易踩设置-i之后程序只处理第一个作品链接所以需要指定图片序号时一次别塞多个链接。用户脚本批量存档的效率开关真正拉开效率差距的是批量场景——想把某个博主主页的作品全存下来一个个复制链接不现实。正确姿势是配合 Tampermonkey 安装用户脚本项目里的static/XHS-Downloader.js它能在网页端一键提取推荐页、账号发布/收藏/点赞/专辑里的作品链接搜索结果里的作品链接和用户链接支持自动滚动页面把内容全部加载完再抓取默认滚动 50 次次数可改。抓到的链接复制出来空格分隔粘进程序输入框批量下载就开始了。更进阶的联动玩法放到后面说。填一个 Cookie解锁更完整的数据程序自 2.2 版本起不填 Cookie 也能正常下载但登录态对数据采集结果有影响想拿到更完整的采集数据可以按需填一个无需登录的网页 Cookie。获取方法大概 30 秒浏览器无痕模式打开小红书 explore 页F12 打开开发者工具切到“网络”标签勾选“保留日志”筛选cookie-name:web_session点开任意请求复制“标头”里的 Cookie 字段粘贴进程序的 Cookie 设置。进阶玩法API、MCP 和脚本服务器命令行和界面之外这个项目还留了两个接口给想自动化的人。API 模式python main.py api启动后访问http://127.0.0.1:5556/docs会看到自动生成的交互式接口文档。核心接口是POST /xhs/detailJSON 格式参数包括url必需、download是否下载、index指定图片序号、cookie、proxy、skip。想把自己的工作流串起来这个接口就是现成的入口。MCP 模式python main.py mcp在支持 MCP 的客户端里配置 URLhttp://127.0.0.1:5556/mcp/就能用自然语言让它“获取某作品的数据”或“下载某作品”下载图文时还能指定图片序号。我在聊天框里直接说“获取作品 52 的数据”它就回给我标题、描述、类型这些结构化信息二次开发的成本很低。脚本服务器让浏览器和程序直接对话在settings.json里把script_server设为true程序退到后台当服务器TUI、API、MCP 模式都支持。这时回到浏览器在用户脚本菜单里点“推送下载任务”脚本就把任务直接甩给程序处理全程不用复制粘贴。这条链路打通之后整个“浏览→收藏→下载”流程基本是无感的。实测数据与避坑清单我在普通家用网络下跑了一轮批量下载记录如下任务耗时备注用户脚本提取 50 个作品链接约 2 分钟自动滚动加载完整个主页批量下载 30 篇图文约 4 分钟平均每篇 8 秒左右批量下载 8 条视频约 7 分钟视频文件较大属正常命令行指定下载某篇笔记第 3、5 张图10 秒内只出两张图精准对比手工存档最大的差别其实不在速度而在文件质量保存下来就是源文件无水印、无二次压缩文件名自带发布时间和作者昵称按作者归档后找素材是直接定位而不是翻相册。踩过的坑按优先级排给你链接要用新鲜的。作品链接里带日期信息放久了会被风控批量下载前重新提取一遍最稳重复下载被跳过是正常设计。想强制重下去Volume/ExploreID.db里删掉对应记录或把配置里的download_record关掉全局代理可能拖后腿。开全局代理时用户脚本下载文件可能失败遇到先关掉代理再试Linux 下“读取剪贴板”功能需要装xclip或xsel否则不工作别去调快请求频率。程序内置了请求延时机制硬改容易触发平台风控默认值就挺好用户脚本的自动滚动功能默认关闭开启后有被平台检测为自动化操作的风险批量抓链接之前想清楚再用Windows 上想从 Chrome/Edge 直接读 Cookie必须以管理员身份运行程序。收个尾工具给了便利怎么用是你的选择用下来的整体感受是XHS-Downloader 把“存小红书内容”这件事的链路做完整了——脚本负责捞链接程序负责解析和下载命令行负责精准控制API 和 MCP 负责跟你的其他工具打通。整条流程里没有一个环节需要你跪着求兼容。最后说句实在话下载的内容请只用于个人学习、研究和素材积累尊重原创作者的版权别拿去商用或二次传播。工具只负责给你便利怎么用底线得自己守。【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具提取账号发布、收藏、点赞、专辑作品链接提取搜索结果作品、用户链接采集小红书作品信息提取小红书作品下载地址下载小红书作品文件项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表