novel-downloader:把 200+ 小说网站的内容存成本地 TXT 与 EPUB

📅 发布时间:2026/8/27 3:03:56
novel-downloader:把 200+ 小说网站的内容存成本地 TXT 与 EPUB novel-downloader把 200 小说网站的内容存成本地 TXT 与 EPUB【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloadernovel-downloader 是一个开源、可扩展的小说下载器以油猴脚本用户脚本形式运行在浏览器里。打开受支持的小说目录页后脚本自动识别站点结构、逐章抓取正文完成后同时生成 TXT 和 EPUB 两种文件把内容完整保存在本地。它适合这几类情况在架小说被删除或站点关停、无网络的通勤时段需要离线阅读、按作者或题材整理个人书库。安装步骤构建脚本并导入脚本管理器它不是独立程序安装分两步。第一步在浏览器安装脚本管理器Tampermonkey、Violentmonkey 或 Greasemonkey 任选其一。第二步克隆源码并构建git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build构建会产出dist/bundle.user.js在脚本管理器中安装这个文件即可。也可以直接安装别人构建好的现成版本自己构建的好处是能更早用上对新版站点的支持。从目录页到成品的使用流程使用流程很短如需下载付费章节先登录对应网站账号并确认已购买打开小说的目录页有的站点需先进入详情页再进目录页面右上角出现下载图标点击开始通过右下角进度条或按 F12 打开控制台查看逐章状态完成后浏览器自动下载 TXT 和 EPUB 两个文件几个容易忽略的细节下载期间脚本会播放一段无声音频防止浏览器把后台标签页休眠。保持标签页打开不要中途关闭章节多时等待时间较长反爬严格的站点会主动放慢抓取速度TXT 用任意文本编辑器或阅读软件打开EPUB 导入常见电子书阅读器即可成品 EPUB 保留了原站的结构分卷标题独立成页目录可直接跳转。含插图的章节会把图片一并打包进文件。TXT 版本则是带分卷分隔线的纯文本兼容任何设备。不同网站为什么都能解析规则与解码机制核心思路是规则模块化。每个站点一份独立解析规则统一放在src/rules/目录下按页面结构分成几类onePage单页承载目录和章节twoPage目录与正文分处两个页面special逻辑复杂、需要专门处理的平台如起点、晋江、pixiv转载站笔趣阁类结构相近的站点共享一套公共规则新增站点时只改对应规则文件和路由注册src/router/download.ts主流程不动这也是它可扩展的含义。反爬方面还有一套解码链路实现位于src/lib/decoders/。部分站点把正文文字替换成图片来阻止抓取脚本按三个阶段还原文件名映射按图片文件名直接匹配文字最快哈希映射计算图片哈希比对匹配表OCR 识别调用 PaddleOCR 模型最准确但最慢首次使用需要下载模型另外晋江、番茄等站点使用自定义字体混淆正文下载时脚本会在日志中输出字体匹配提示照着提示提交匹配信息后再次下载即可恢复正常。自定义下载设置章节筛选与参数调整不想下整本或想降低对站点的压力有两处可调。章节筛选开始下载前按 F12 在控制台定义chapterFilter函数返回 true 的章节才会被抓取。例如只下前 50 章window.chapterFilter (ch) ch.chapterNumber 50;下载参数在设置面板启用自定义下载设置可调整并行下载线程数和章节间隔毫秒。每个站点都预设了合理默认值一般不需要动只在站点加强反爬或下载频繁中断时再调整并把新数值反馈给项目。输出也可以微调比如自定义 EPUB 正文样式段落缩进、行距和章节标题格式都通过保存参数配置完成。常见问题与排查下载卡住先看 F12 控制台有无报错再降低并行线程数、拉大章节间隔。文本乱码通常是自定义字体混淆导致。在设置中开启调试模式按日志里的字体匹配提示处理后重新下载。付费章节部分站点支持前提是已登录且已购买对应章节未购买的章节会被直接跳过个别站点的 VIP 章节仅支持图片版。支持哪些网站200 站点涵盖起点、晋江、刺猬猫、番茄、七猫、长佩、SF以及カクヨム、小説家になろう等日文站点完整清单见项目 README 的支持列表。右上角没有下载图标说明该站点暂不支持或属于单页应用页面按 F5 刷新一次个别站点需要先进入作品目录页。这个项目同时是404 小说文库计划的组成部分不少网络小说会毫无征兆地下架脚本的目标就是为质量不错、却没被其他站点转载的作品留一份可读的副本。遇到不支持的站点或下载异常带上调试日志提交 issue 是最有效的推动方式。先用前几章测试一下效果确认解析正常后再进行整本下载能少走大部分弯路。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考