追更多年的小说忽然消失,我靠一个浏览器脚本把 100+ 网站的连载全部抢救回了本地
2026/8/19 13:12:44 网站建设 项目流程

追更多年的小说忽然消失,我靠一个浏览器脚本把 100+ 网站的连载全部抢救回了本地

【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader

如果你的书单里有一本追了三年、已购付费章节的小说,突然有一天它"404"了,你会怎么办?我遇到过——那是一个普通的工作日夜晚,我照常打开网站想刷今天的更新,页面却只剩下冰冷的"您访问的页面不存在"。我翻遍书架、网盘、论坛求助帖,都找不到它的完整版本。那一刻我才意识到:在线阅读最大的风险,不是网速慢,而是内容会凭空消失。

后来我找到了一个名叫novel-downloader 的小说下载工具,它是一款开源的浏览器脚本,专门解决"网页小说离线阅读"难题——把起点、晋江、刺猬猫、pixiv 等 100 多个小说网站的章节内容一键抓取,打包成 TXT 和 EPUB 电子书,稳稳存进你的硬盘。从此,心爱的小说再也不怕下架,地铁上没网也能继续追更。这篇文章,就把我"抢救书架"的全过程分享给你。

第一次遇见它:藏在浏览器右上角的小图标

novel-downloader 不是需要安装的独立软件,而是一个油猴脚本(用户脚本)。装好之后,它不会打扰你,直到你打开一本受支持小说的目录页——这时网页右上角会悄悄出现一个下载图标,像书店门口挂出的"本店可打包外带"的牌子。

点击图标,脚本便开始工作:

  • 自动识别当前网站的页面结构,逐章抓取正文
  • 右下角弹出下载进度条,随时告诉你"还剩多少章"
  • 完成后自动生成TXT 与 EPUB 两种格式,分别适合手机阅读器和专业电子书设备
  • 支持批量操作,多个标签页可同时下载不同书籍

它解决的痛点很朴素:付费章节永久保存、无网络离线阅读、跨设备自由传书。我下载完第一本后,随手把 EPUB 丢进手机里的阅读 App,通勤地铁上全程飞行模式,照样读得津津有味。

动手一试:从安装脚本到导出第一本电子书

整个过程大约十分钟,跟着做就能成功。

第一步:装一个脚本管理器

浏览器扩展商店搜索并安装 Tampermonkey(最流行)或 Violentmonkey(开源轻量)即可,它们是脚本的"运行环境"。

第二步:获取并构建脚本

打开终端,按顺序执行:

git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build

构建完成后,dist目录里会出现bundle.user.js文件——这就是最终要安装的脚本本体。

第三步:安装脚本

bundle.user.js拖进脚本管理器界面,确认安装。随后访问任意支持的小说网站目录页,右上角看到下载图标,就说明安装成功。

第四步:开始下载

点击图标,等待进度条走完,浏览器会自动下载 TXT 和 EPUB 两个文件。特别提醒:下载过程中脚本会播放一段无声音频,这是为了保证后台任务不被浏览器休眠,属于正常现象,不必惊慌。

玩转进阶:原来还能这样用

当你用过基础功能,会渐渐发现这脚本藏着不少惊喜——它本质上是一套可以自由定制的"下载流水线"

章节筛选,只存想看的

只想保存正文前 50 章?或者只想留"番外"?可以在设置里写一个简单的过滤条件,脚本会按你的规则跳过不需要的章节。

自定义章节命名与排版

默认输出是"第一章 标题"这种格式,但你完全可以改成自己的习惯,比如给 TXT 的每个自然段前加两个空格、调整段间距,让导出文本更贴合你的阅读口味。

断点续传,中断也不慌

网络波动导致下载中断?重新开始即可,脚本会自动跳过已经完成的章节,接着往下抓,不会前功尽弃。

多标签并行,批量存书

想一次性备份整个书架?可以同时打开多个标签页分别下载不同的小说,配合可控的请求间隔,既高效又不至于给网站服务器造成压力。

原理浅谈:它如何"见招拆招"

不同网站的反爬手段五花八门,novel-downloader 的应对方式也像一套层层递进的"翻译方案"。

文件名当密码本——有些网站把正文藏进图片里,但图片文件名恰好对应着某个字。脚本会先拿文件名直接查"对照表",这是最快的路径,一秒钟能解好几章。

哈希值当指纹——如果文件名不再可靠,脚本就把图片下载下来、计算特征值去匹配已知字库。相当于给每张图"按指纹",准确率更高,速度略慢。

OCR 当翻译官——碰上更刁钻的网站,脚本会动用本地运行的 OCR 文字识别模型,把图片里的字一个个"读"出来。最慢,但几乎通吃,相当于请了一位随叫随到的翻译官。

字体加密当暗号——晋江等网站会把文字渲染成自定义字体的乱码。脚本的做法是下载字体文件,反推出每个"乱码字形"对应的真实字符,等于破译了网站专属的"暗号"。相关逻辑可以在src/rules/special/jjwxc.ts中一探究竟。

Shadow DOM 当密室——部分网站用封闭的 Shadow DOM 把正文藏进"密室",脚本则通过注入attachShadow拦截器、穿透影子节点,把内容一层层挖出来(参考src/lib/pierceShadow.ts)。这些奇招,都是开发者在真实站点上一次次踩坑换来的。

避坑指南:老用户踩过的坑,你别再踩

  • 下载中途卡住:先耐心等一会儿,必要时按 F12 打开控制台查看进度;仍无反应可在设置中开启调试模式,把日志发给项目方排查。
  • 付费章节下不下来:下载前请务必登录对应网站账号,并确认已购买该章节;未登录或未购买的部分会被直接跳过。
  • 导出后全是乱码或方块:通常是字体加密章节没有正确解码,升级到最新版脚本再试一次;个别站点受反爬限制,可能需要配合登录状态使用。
  • 请求太快被网站限流:在设置里适当拉大下载间隔,给服务器留点"喘息空间",既保护站点,也能提高成功率。
  • 安装后没看到下载图标:先确认网站是否在支持列表内,再检查脚本管理器是否已启用;也可以刷新页面后重试。

收尾:给心爱的故事一个"永不消逝"的存档

我们常说"阅读是一种习惯,保存是一种责任"。在内容随时可能消失的互联网时代,novel-downloader 这类小说下载工具,其实是给每一位读者发放的"数字保险"——它让好作品不因平台调整、网站关停而彻底失传,让已购买的章节真正归你所有,也让离线阅读成为一种随时可得的自由。

如果你也有放不下的小说,或者想为某个小众但精彩的故事留一份备份,现在就动手试试吧:装好脚本管理器,构建安装这个浏览器脚本,把第一本电子书导出来。遇到问题可以带着详细日志去项目社区反馈,会写代码的朋友还能在src/rules/目录里为新网站添砖加瓦——每一本被保存下来的书,都是对这个时代最温柔的抵抗。

【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询