小说下载器完整指南:200+网站一键批量下载,把小说永远留在本地
2026/8/16 19:19:15 网站建设 项目流程

小说下载器完整指南:200+网站一键批量下载,把小说永远留在本地

【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader

这篇小说下载器完整指南,源自一位常年混迹各大小说网站的老读者的真实使用报告。文中会讲清楚三件事:它凭什么能覆盖200多个小说站点、如何一次点击批量下载整本小说,以及怎样用筛选和定制功能,把它调教成真正属于自己的离线书库工具。没有晦涩的技术术语,只有亲测过的路径和踩过的坑。

第一章 那本一夜之间消失的书

凌晨一点,我照常刷新追更了八个月的那本书,屏幕却弹出一行冷冰冰的提示:404,页面不存在。

一开始我以为只是临时维护,刷新几次,换设备,换网络,结果都一样。那本书连同它所在的网站,像是从未存在过一样,从互联网上蒸发了。更扎心的是,我明明订阅过、付费过、每天追更过,却连一页正文都没能留下——我读过的每一章,都只存在于服务器上,而服务器说关就关。

后来我才知道,这种事远比想象中普遍:起点、晋江、刺猬猫、SF 上都有过小说毫无征兆下架的记录,有些作品不够火,连笔趣阁这类转载站都没人转,一旦下架就是彻底消失,后来的读者想看一眼都找不到入口。

正是为了对付这种"数字时代的人间蒸发",才有了这个名叫小说下载器的开源项目。它最初脱胎于一个名为"404 小说文库"的保存计划:把质量上乘、但不够热门、随时可能消失的作品抢先留存下来。脚本在征得你同意后,还会顺手把书籍详情页和目录页存档到互联网档案馆,相当于给每本书都上了一份"意外险"。

第二章 为什么这次我不再手动复制粘贴

在遇见它之前,我的"保存小说"方式相当原始:一页一页复制、粘贴进 Word,再手动改格式、补标题。一千章的书,光是整理目录就能耗掉一个周末,更别提图片章节、特殊字体这些"附加题"。

下载器的思路完全不同——它不做搬运工,而是当管家。你只要打开目录页,它自己读章节列表、挨个抓正文、整理成册,最后交给你两个成品:TXT 和 EPUB。我把它和过去的方法放在一起对比,差距一目了然:

我的老办法现实打击换成它之后
手动复制粘贴格式乱、章节错、耗时以天计智能解析,结构完整,一键成册
截图存手机没法搜索、占内存、看不清生成可检索的文本与电子书
同时装七八个阅读 App账号分散、书也分散一个脚本覆盖 200+ 站点
只在网页上看断网就抓瞎、下架就没本地保存,离线随时读

不需要注册账号,不需要安装额外软件,它就是一个跑在浏览器里的油猴脚本。你过去最头疼的"跨平台资源分散",到这里变成了一个统一入口。

第三章 十分钟拿到第一本离线书

整个上手过程比我预想的短得多,拆开看其实就三步。

第一步:给浏览器配一个"脚本管家"

小说下载器以用户脚本的形式运行,需要脚本管理器来托管。三选一即可:功能最全面、社区最活跃的 Tampermonkey;轻量开源、注重隐私的 Violentmonkey;以及 Firefox 用户的老朋友 Greasemonkey。装好任何一个,浏览器地址栏旁边就会多出一个脚本管理入口。

第二步:把脚本"请"进来

不想折腾的话,直接下载编译好的脚本文件,拖进脚本管理器界面就完成安装了,全程不到一分钟。

如果你喜欢追最新功能,也可以走开发者路线,克隆仓库自己编译:

git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn run build

编译产物就是最终的bundle.user.js,导入脚本管理器即可。

第三步:打开目录页,点右上角的图标

安装完成后,访问任意受支持的网站,打开小说的目录页,右上角会出现一个下载图标。点击它,剩下的事情就不用你操心了:脚本会自己解析目录、逐章抓取正文、组装文件,右下角有实时进度条,按 F12 还能在控制台看到更详细的状态。

有个小细节值得单独说:下载过程中脚本会播放一段无声音频,目的只是防止浏览器在后台被系统休眠中断任务。你听不到任何声音,也完全不用手动操作。

等进度条走完,浏览器会自动弹出两个文件——TXT 文档和 EPUB 电子书。TXT 用记事本或任意阅读软件就能打开,EPUB 则交给专门的阅读器。从点击图标到拿到成品,我实测最快的一本两百章的书,十几分钟就完成了。

第四章 遇到"硬骨头"网站怎么办

不是所有网站都那么好说话。有的站点为了防爬,会把文字替换成图片;有的会用自定义字体加密正文;还有的干脆限制下载频率。小说下载器针对这些"硬骨头"准备了一套组合拳。

破解"文字变图片"的三把钥匙

遇到正文全是图片的站点(比如西瓜书屋),脚本会依次尝试三种解码方式,像开密码锁一样逐层解锁:

  1. 文件名映射:先看图片文件名能不能直接对应到文字,最快,毫秒级出结果。
  2. 哈希映射:文件名对不上就下载图片、计算哈希值去匹配,速度和准确性都不错。
  3. OCR 识别:前两把钥匙都打不开时,才动用光学字符识别来读图,最准也最慢。它用的是 PaddleOCR 中文模型,首次使用会从网络下载模型并保存在本地。

字体乱码的终结点

如果你下载的小说出现乱码,别急着删文件。先打开设置里的调试模式或测试视图看日志,如果看到[jjwxc-font][fanqie-font]开头的提示,说明是晋江文学城或番茄小说的字体加密在作祟。按提示把字体链接反馈给维护者,更新匹配表之后,同样的书就能正常下载了。

反爬严格的网站:慢就是快

像长佩文学这类站点,会把下载速度压到每分钟六章左右。这时候最忌讳的就是开多个页面同时下载好几本书——不仅不会更快,还可能触发更严厉的限制。规规矩矩单线程下载,反而最稳妥。

第五章 进阶玩法:把下载器调教成私人编辑

用熟基础功能之后,你会发现这个脚本真正的价值在"可定制"。

只想要某一段剧情?写个筛选函数

追连载的人都知道,长篇小说动辄上千章,全量下载既占空间又费时间。在控制台定义一个chapterFilter函数,就能精准圈定范围:

// 只下载第一卷 function chapterFilter(chapter) { return chapter.sectionNumber === 1; }

想只存前一百章、只存包含某关键词的章节,都是改一行条件的事。函数在点击下载前定义好即可,返回true的章节才会被收录。

输出格式由你定

如果你对成品有"洁癖",saveOptions能接管标题格式、段落样式、甚至 EPUB 的内部排版。比如把章节名统一改成"第几章 + 标题"的格式:

const saveOptions = { getchapterName: (chapter) => { return `第${chapter.chapterNumber}章 ${chapter.chapterName ?? ""}`; }, }; window.saveOptions = saveOptions;

下载完成后自动收尾

脚本还留了一个完成回调接口customFinishCallback,下载完成并打包后会执行你写的逻辑。比如自动关掉当前窗口、弹出提醒,甚至是把文件挪到指定目录——适合批量下载多本书的场景。

调速度的三根旋钮

设置面板里还有三个参数可以微调:并行下载线程数(同时抓多少章)、单线程下的下载间隔、以及最大间隔上限。默认值对大多数网站已经足够友好,只有当你明显感觉到被限速时,才需要手动降低线程数、拉大间隔。这些参数作用于所有站点,改完记得用极速下载再验证一次。

第六章 五个高频问题与我的答案

Q:下载特别慢,是脚本的问题吗?多半不是。这通常是目标网站的反爬策略,试试把并行线程降到 1~2 个,同时适当加大下载间隔。对长佩这类严格限速的站,耐心单线程跑就是最优解,别同时开多本书。

Q:下载完发现一堆乱码/特殊字符?先开调试模式看日志里有没有字体匹配提示。晋江和番茄的字体加密需要人工配合更新匹配表,按日志里的提示反馈即可。千万别把这类信息直接丢进 issue 区,维护者会直接关闭的。

Q:下载到一半卡住了,怎么排查?按 F12 看控制台实时状态,并检查下载生成的文件包里有没有debug.log。如果卡到连文件都没生成,就打开设置里的测试视图,把日志选项卡的内容完整复制下来,连同问题描述一起提交给维护者。

Q:付费章节为什么下不下来?脚本不会绕过付费,未登录或未购买的章节会直接跳过。先确认已登录并购买,部分网站还需要额外配置凭证,比如晋江文学城的 token、息壤中文网的 deviceIdentify 和 Authorization,按官方文档里的抓包教程操作即可。

Q:我想用的网站不在支持列表里,怎么办?项目是模块化设计的,加新站有清晰套路:在 src/rules/ 下新建规则文件,继承BaseRuleClass并实现解析方法,再在 src/router/download.ts 注册路由、在header.json里补上匹配规则,编译后就能用。如果你会一点前端,完全可以自己动手,或者把请求反馈给社区。

第七章 它最适合谁,什么时候用最划算

  • 追更多年的老书虫:手头书多、跨平台、担心哪天就"404"的,越早建本地书库越安心。
  • 通勤族与旅行党:地铁、飞机、偏远地区,网络时好时坏,离线书是最靠谱的旅伴。
  • 写作者与学习者:需要反复研读文本、做笔记、分析结构的人,本地 TXT/EPUB 比网页好操作太多。
  • 被反爬折腾过的下载苦手:手动复制到怀疑人生的,让它替你干脏活累活。

最划算的使用时机,永远是"书还在"的时候。看到一本喜欢但不算热门的作品,与其赌它不会下架,不如现在就存一份——这本小说下载器,本质上买的是安心。

写在最后:用好工具,也守住边界

回想那本消失的书,我现在的心态已经完全不同:它教会我的不是"免费爬资源",而是"重要的内容要主动保存"。小说下载器给了我这种主动性,但它的正确用法,始终是服务正版读者——下载已购章节做备份、把公共章节整理成册、把喜欢的故事留在自己手边。

它不该被用来批量盗取付费内容,也不会绕过任何付费机制。对还在连载、还在更新的作者,请继续在平台上支持他们;对已经消失的作品,我们至少可以替它留一份档案。这既是工具的初衷,也是每一位读者能做的、最有意义的事。

现在就去试试吧:装好脚本管理器,把下载器请进浏览器,打开你最爱的那本书的目录页。十分钟后,你会多一份永远属于自己的收藏。

【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询