尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

十分钟上手novel-downloader 批量小说下载100+站点 离线生成TXT与EPUB

十分钟上手novel-downloader 批量小说下载100+站点 离线生成TXT与EPUB 十分钟上手novel-downloader 批量小说下载100站点 离线生成TXT与EPUB【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloadernovel-downloader 是一个跑在浏览器里的小说下载器基于油猴脚本实现不需要额外安装桌面软件。它从 100 多个小说网站逐章抓取正文在本地合成 TXT 和 EPUB 两种格式。适合想离线阅读、或把已购章节备份到个人设备的读者。下文按顺序覆盖安装、原理、筛选、排障和新站点规则写法。 核心能力一览整本小说下载只需一次点击打开目录页后点右上角图标脚本自动遍历所有章节并合成两个成品文件。100 站点的解析规则内置起点、晋江、长佩、刺猬猫、SF 轻小说、カクヨム等各有独立解析器你不用自己找插件。三级解码还原图片文字先按文件名映射再按图片哈希匹配最后用 OCR 识别逐级兜底。付费章节只下已购部分登录后未购买的章节自动跳过不做绕过。过程可观察右下角进度条实时刷新控制台同步输出每一章的结果。章节插图随文保存正文中的图片会一并抓取并嵌入 EPUB。 安装导入步骤从克隆到第一次成功安装脚本管理器浏览器里装好 Tampermonkey、Violentmonkey 或 Greasemonkey 任一扩展。克隆并构建源码生成最终脚本git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build导入脚本在脚本管理器中新建脚本把 dist/bundle.user.js 的完整内容粘贴进去保存。打开目录页访问受支持网站的小说目录页等页面加载完成。点击下载图标右下角进度条开始刷新控制台逐章输出抓取结果。取走文件小说下载完成后浏览器自动保存 TXT 和 EPUB用记事本或阅读器打开即可。⚙️ 工作原理模块化规则与三级解码140 余个站点的解析逻辑都单独写成 TypeScript 规则文件统一放在 src/rules/ 下按页面结构分目录单页模式目录与正文同页、双页模式目录页和正文页分离、特殊模式需要登录或登录墙处理。每条规则只做两件事bookParse 读目录页拿到章节清单chapterParse 抓正文并清洗广告节点。新增网站不用改核心代码加一个文件再注册路由即可。部分站点用反爬手段保护正文。图片替换文字是其中一种站点把每个字渲染成小图片直接抓 HTML 只会得到一堆图片链接。脚本在 src/lib/decoders/ 里按文件名映射、图片哈希、OCR 识别三级顺序还原文字前两级命中就不会动用最慢的 OCR。字体加密是另一种网站把文字换成自定义字体显示直接复制会是乱码脚本会下载字体并建立字符映射。下载任务运行时脚本会播放一段无声音频防止浏览器把后台标签页休眠。️ 进阶玩法章节筛选与输出定制如果只想下载部分内容按 F12 在 window 下定义 chapterFilter返回 true 的章节才会被抓取例如只下第一卷function chapterFilter(chapter) { // 想只下前 100 章可改为 chapter.chapterNumber 100 return chapter.sectionNumber 1; } window.chapterFilter chapterFilter;想统一章节标题格式可以在 window 下定义 saveOptions需先在设置里勾选“启用自定义下载设置”const saveOptions { getchapterName: (chapter) 第${chapter.chapterNumber}章 ${chapter.chapterName ?? }, }; window.saveOptions saveOptions; 真实使用场景通勤族小林每天地铁里没有信号。她周末挑两本读完的完本小说在目录页点一次图标开始小说下载周一上车直接打开 EPUB不用抢流量。有读者收藏的一部老作品首发站改版后原目录页打不开了转载站上的版本格式混乱。她用 TXT 版存了一份纯文本副本之后整理引用时不用再登录任何网站。做文本分析的同学用它做语料准备chapterFilter 筛出目标卷TXT 输出格式统一导进分析工具前不需要再手工清洗。 故障排查速查表现象可能原因处理方式右上角不出现下载图标站点未支持或单页应用未渲染完成核对支持站点列表按 F5 刷新后等目录页加载完某章正文出现异常字符站点启用字体加密缺字符映射设置里开调试模式按 [jjwxc-font] 类日志提示补充字体匹配下载明显变慢站点限速如长佩约 6 章/分钟或并发过高调低并行线程数、加大下载间隔别同时下多本付费章节缺失未登录或该章节未购买登录站点账号并确认已购买未购章节会被跳过批量小说下载卡住、无文件生成章节请求失败或被拦截开调试模式收集 debug.log仍失败再开测试视图复制日志 扩展与贡献为新站点写规则解析规则决定小说下载能否成功而新增一条规则只涉及三个位置继承 BaseRuleClass 并实现 bookParse 与 chapterParse 两个方法在 src/router/download.ts 注册路由在 src/header.json 的 match 字段加入匹配规则。规则文件放进对应页面结构的目录即可改动范围被限定在单个文件内。src/ ├── rules/ │ ├── onePage/ # 目录与正文同页 │ ├── twoPage/ # 目录页与正文页分离 │ └── special/ # 登录或特殊解码 └── router/download.ts # 路由注册入口请只下载自己已购买或有权阅读的内容把工具用在离线阅读和备份上。如果你常看的站点还没被支持按上面的步骤写一个规则文件就是最好的上手方式。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表