尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

把小说存到本地:用 novel-downloader 批量下载小说到 TXT 和 EPUB 的实用指南

把小说存到本地:用 novel-downloader 批量下载小说到 TXT 和 EPUB 的实用指南 把小说存到本地用 novel-downloader 批量下载小说到 TXT 和 EPUB 的实用指南【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloadernovel-downloader小说下载器是一个可扩展的通用型油猴脚本打开小说目录页后它自动识别网站结构、并行抓取所有章节并把整本书以 TXT 和 EPUB 两种格式保存到本地用于离线阅读和长期存档。小说下载器能帮你解决什么应对内容消失。起点、晋江、刺猬猫、SF 等平台上的作品可能随时下架转载站也未必长期保留。提前把整本书落到本地是最直接的备份方式。离线场景阅读。通勤、长途出行、飞行途中没有网络时TXT 可以直接用手机文本类阅读器打开EPUB 可导入 Kindle 等电子书设备。保留图文混排内容。章节正文中的插图会随文本一起下载并嵌入文件不会只剩干巴巴的文字。绕过显示层干扰。广告、追踪参数、反爬占位符在解析阶段会被清理输出的正文相对干净。它凭什么能做到网站识别与反爬解码novel-downloader 的解析逻辑按网站类型拆分在 src/rules/ 目录中匹配规则统一配置在 src/header.json按域名把请求路由到对应的规则文件单页型站点src/rules/onePage/目录页即包含全部章节入口多页型站点src/rules/twoPage/目录需要翻页展开特殊站点src/rules/special/需要字体解密、Token 登录或整本书一次性加载的平台单独实现。针对常见的反爬手段src/lib/decoders/ 提供了几套解码管线图片文字三步解码部分站点把文字渲染成图片。脚本先按图片文件名直接匹配文字匹配不到就下载图片计算哈希值比对最后才调用 PaddleOCR 做光学字符识别。前两步速度快OCR 最慢但最兜底。字体加密还原晋江文学城、番茄小说等使用自定义字体映射显示文字。脚本会下载字体文件并建立字符映射下载后若出现异常字符可在日志中看到字体匹配提示再按提示提交更新。请求层防护章节下载支持并发控制与间隔策略连续失败会中止任务并保留现场日志避免无效重试触发更严的风控。从安装到跑通第一次下载整个流程分三步装脚本管理器、构建脚本、打开目录页点击下载。第一步安装脚本管理器。在浏览器中任选其一Tampermonkey功能最全、Violentmonkey开源、GreasemonkeyFirefox。第二步获取脚本。如果只需要使用可以直接从脚本管理器商店安装如果要体验最新代码或参与开发则克隆仓库自行构建git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build构建完成后把dist/bundle.user.js导入脚本管理器即可。第三步执行下载。打开任意受支持站点的小说目录页右上角会出现下载图标点击后脚本开始工作页面右下角的进度条显示章节进度按 F12 可在控制台查看每一章的抓取日志下载期间脚本会循环播放一段无声音频用于防止浏览器休眠后台标签页全部章节完成后浏览器会自动下载一个 TXT 文件和一个 EPUB 文件部分站点另含原始 HTML 的 ZIP 包保存逻辑位于 src/save/。支持哪些小说网站受支持的站点在 src/rules/ 下逐一实现目前覆盖百余站典型的有类别代表站点国内原创平台起点中文网、起点女生网、晋江文学城、长佩文学、SF 轻小说、番茄小说、七猫中文网、纵横中文网、17K、塔读、书海轻小说与海外平台カクヨム、小説家になろう、暁、ハーメルン、pixiv 小说、Novel Up、真白萌masiro转载与文库站笔趣阁系列、UU 看书、努努书坊、和图书、轻之文库、西瓜书屋、红袖招两点使用说明付费章节需先在对应网站登录并确认已购买未登录或未购买的章节下载时会被自动跳过单页应用如 pixiv、长佩若打开书籍详情页后没出现下载图标按 F5 重新加载页面即可。把它调成自己的样子在设置面板中可以修改三项下载行为并行线程数同时下载的章节数、下载间隔与最大下载间隔仅单线程时生效。多数站点已内置合适的默认值只有当目标站点加强反爬时才需要手动调整。只下载部分章节时可自定义筛选函数先按 F12在window上挂一个chapterFilter再点下载图标。例如只下载前 100 章function chapterFilter(chapter) { return chapter.chapterNumber 100; }输出样式则由window.saveOptions控制可改章节标题格式、正文段落样式缩进、行高、章节排序等参数定义见 src/save/options.ts。习惯性的配置可以另写一个用户脚本自动注入避免每次重复粘贴。卡住了看这里常见问题与处理下载按钮不出现先确认站点是否在支持列表中单页应用站点按 F5 刷新仍不行则检查脚本管理器是否启用、站点是否命中了 header 中的匹配规则。下载速度很慢长佩等站点反爬较严约每分钟 6 章此时降低并行线程数、拉大下载间隔并避免多开页面同时下载多本。文本出现乱码或异常字符多为字体加密站点未完成字体匹配。开启调试模式后查看日志找到以[jjwxc-font]或[fanqie-font]开头的提示按提示提交字体更新部分平台还需按文档说明填写 Token。付费章节没下载下来确认已登录且已购买否则章节会被静默跳过。问题反馈请到项目 issue 区提交并附调试日志下载生成的 ZIP 中自带debug.log。评论区、交流群里的反馈不会被处理。想参与共建架构与新增网站代码结构按职责分层改规则之前先大致了解即可src/ ├── rules/ 各站点解析规则按 onePage / twoPage / special 分类 ├── main/ Book、Chapter、Attachment 核心模型 ├── lib/ HTTP、解码、DOM 处理等通用工具 ├── save/ TXT / EPUB / ZIP 生成 ├── ui/ 设置面板、进度条、测试视图 └── router/ 下载路由与下载调度新增一个站点支持的四步在 src/rules/ 对应类型目录下新建规则文件继承BaseRuleClass实现bookParse解析书名与目录和chapterParse解析章节正文两个方法在 src/router/download.ts 中注册新规则在 src/header.json 的 match 字段中加入域名匹配yarn dev本地起代理脚本验证yarn build出包。规则实现原则是小而专优先写只适配目标站点的最小规则不做通用层的扩散式改动选择器必须以真实抓取的 HTML 为依据不要凭页面快照猜测。上手建议新手可先从转载类站点笔趣阁系列开始测试用短篇验证流程熟悉后再处理晋江、长佩这类需要 Token 或字体匹配的平台。请只下载你有权阅读或已购买的内容把本地存档当作备份而非扩散渠道。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表