
novel-downloader 小说下载器覆盖 200 网站一键转存 TXT/EPUB 离线阅读【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloadernovel-downloader 是一个可自建的油猴小说下载脚本把 200 小说网页整本存成 TXT/EPUB给需要离线阅读与语料留存的读者。它不做网页采集只做三件事认出站点、取出正文、打包成文件。⚡ 三步跑通装好 Tampermonkey 或 Violentmonkey再安装bundle.user.js。打开任意已支持的站点目录页右上角出现下载图标即装成功。打开一本书的目录页点击图标。右下角进度条开始滚动控制台同步打印章节状态。进度走完后浏览器自动保存 TXT 与 EPUB 两个文件用记事本或任意 EPUB 阅读器打开即可。输入200 站点结构自动识别不同站点的页面组织方式差异很大有的整本书挤在一页有的目录分页有的目录和正文分开。脚本按这四类结构为每个站点写一条独立规则规则集中在 src/rules/路由与匹配入口在 src/router/download.ts。识别成功的前提是 URL 命中匹配表命中不了页面右上角不会出图标。认出站点只是入口接下来要看正文怎么被保护。处理乱码与图片字三重解码部分站点用字体混淆或把文字做成图片来拦截抓取。src/lib/decoders/ 按成本从低到高依次尝试文件名直接映射文字、下载图片算哈希查表、最后用 PaddleOCR 识别。OCR 首次使用会拉取中文识别模型耗时较长但准确率最高且仍不保证 100% 正确。正文取出来后还要按原结构重新排版。输出TXT/EPUB 双格式与进度展示src/save/ 负责生成 TXT、EPUB 和网页预览三套产物分卷标题与章节层级都会保留含图章节会把图片一并下载进 EPUB。进度与设置面板由 src/ui/ 提供下载期间脚本播放无声音频防止后台标签页被浏览器休眠。三个落地场景通勤上班族地铁信号差。把已订阅的书整本存进手机通勤时段离线读完。独立研究者需要大批量网文语料。逐站下载目录页得到可分析的 TXT 样本集。付费读者担心订阅章节随站点变动失效。按卷筛选下载拿到本地留存的 EPUB。避坑手册现象右上角没有下载图标。原因站点不在匹配表或页面是单页应用、首屏未加载完。处置按 F5 刷新仍无效则说明站点未收录只能提 issue 反馈。现象下载文件出现乱码或异常字符。原因站点用自定义字体混淆正文晋江、番茄常见。处置设置里开调试模式看日志中[jjwxc-font]一类提示按提示做字体匹配。现象付费章节在文件里缺失。原因脚本不绕过登录墙未登录或未购买的章节直接忽略。处置先在网站登录并购买再发起下载。现象章节较多时进度不动。原因后台标签页被浏览器降权休眠。处置保持标签页在前台或调低并行线程数、加大下载间隔。进阶组合只下部分章节在控制台给window挂一个chapterFilter返回值为false的章节会被跳过配合批量站点列表就能做定向采样function chapterFilter(chapter) { return chapter.chapterNumber 100 || chapter.sectionNumber 1; }想统一命名和排版同样在window上挂saveOptions命名函数和正文样式各管一段互不冲突const saveOptions { getchapterName: c 第${c.chapterNumber}章 ${c.chapterName}, mainStyleText: p { text-indent: 2em; line-height: 1.6; }, }; window.saveOptions saveOptions;novel-downloader 把在线章节变成本地文件是数字阅读的保底方案。下一步挑一本常读的书先试下前几章确认 TXT/EPUB 排版无误再整本下载遇乱码先开调试日志别急着下整本。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考