ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

小说下载器入门指南:一键把热门站点的整本小说存进本地

小说下载器入门指南:一键把热门站点的整本小说存进本地 小说下载器入门指南一键把热门站点的整本小说存进本地【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader小说站点说变就变站点关停、作品下架你收藏的页面随时可能 404。novel-downloader 是一个跑在浏览器里的用户脚本打开受支持站点的书籍目录页点一下下载图标它就把整本书逐章抓下来导出为 TXT 和 EPUB 两种格式。不用装软件、不用注册账号十分钟就能把第一本书存进本地。这脚本算什么一句话定位加三个特点把它理解成你浏览器里的「批量档案员」它自己不生产内容而是把你当前登录状态下能看到的页面一页页搬进本地文件装订成整整齐齐的书。三个特点先记住覆盖广一百多个国内外小说站点都做了专用适配规则从起点到日本カクヨム懂对抗文字变图片、字体加密这类反爬手段有对应的解码方案可调下哪些章节、成品什么排版、下载节奏快慢都能按你的习惯改。 从安装到首次下载成功一共几步浏览器里装一个脚本管理器Tampermonkey、Violentmonkey、Greasemonkey 任选其一在管理器里新建脚本粘贴成品脚本bundle.user.js的全部内容。想自己构建的话克隆仓库编译一次git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build成品就在dist/bundle.user.js。打开任意受支持站点的书籍目录页页面右上角会出现下载图标点击图标开始下载页面右下角的进度条能看到实时进度进度条走完浏览器自动下载一个 TXT 和一个 EPUB收工。上图是下载进行中的画面页面停在目录页控制台里逐章滚动抓取日志左下角已经能看到正在生成的 TXT 和 zip 文件。下载期间脚本会播一段无声音频那是它在防止浏览器把页面休眠属于正常现象不用慌。❓ 先对照这张避坑表少走弯路现象常见原因解决办法右上角没有下载图标单页应用未完成初始化按 F5 强制刷新页面付费章节被整体跳过未登录或未购买登录站点账号确认已购成品文档出现乱码字符字体加密未完成匹配留意控制台的字体提示见下文进阶下载速度慢站点反爬限速在设置里调高并行线程数、调低间隔下载卡住没有产出文件需要日志排查设置里启用测试视图复制日志内容都解决不了的话先在设置里开启调试模式再下一次生成的 zip 里会附一份debug.log把日志和项目 issue 一起提交给开发者定位问题会快很多。点完图标后台在忙什么整套流程是一条固定的四段流水线解析目录把书名、简介、分卷和章节链接整理成结构化清单→抓取章节按清单逐章请求正文看不见的付费章节直接跳过→清洗内容去掉广告和导航只留正文与插图→打包输出按模板生成 TXT 与 EPUB插图一并嵌入。上图是脚本解析完一本书后的样子标题、封面、简介和分卷章节列表都整理好了确认章节清单完整后再点开始最稳妥。有些站点比如西瓜书屋会把正文藏进图片里脚本按先快后准的顺序做三层解码先文件名映射直接拿图片文件名查表匹配文字查不到就哈希匹配下载图片算哈希后和远程映射表比对前两层都没命中才动用OCR 识别用 PaddleOCR 中文模型认图中的字。映射表会自动拉取并缓存在脚本管理器的本地存储里OCR 模型也是首次使用才下载。如果三层都没救回来个别字用 HTML 版成品核对一下即可。另一类常见手段是字体加密正文用自定义字体渲染直接抓到的就是乱码。晋江文学城、番茄小说目前可能需要你手动配合一次当控制台出现以[jjwxc-font]或[fanqie-font]开头的提示时按提示内容提交字体映射更新后续同类书就能自动匹配了。⚙️ 进阶两招选章节下载、调成品排版只下部分章节在点击下载按钮之前按 F12 打开控制台定义一个chapterFilter函数只有返回true的章节会进入队列比如只下前 100 章function chapterFilter(chapter) { return chapter.chapterNumber 100; }调整成品排版同样方式注入一个window.saveOptions对象比如把所有章节名统一成第 N 章 标题风格const saveOptions { getchapterName: (chapter) 第${chapter.chapterNumber}章 ${chapter.chapterName}, }; window.saveOptions saveOptions;再强调一次时机所有注入都必须发生在点击下载按钮之前脚本读不到就会按默认配置跑。上图是下载完成的 TXT 成品用任意文本编辑器打开分卷、章节层级分明不联网也能读任何阅读软件都能识别。覆盖了哪些站点类型代表站点国内原创平台起点中文网、晋江文学城、番茄小说、七猫中文网创作社区Lofter、长佩文学、pixiv日本平台カクヨム、小説家になろう、ハーメルン转载与免费站笔趣阁系列、UU 看书、轻小说文库完整清单见 README.md 的目前支持小说网站一栏其中标明的付费章节需要你已登录并购买否则会直接跳过。想给新站点做适配的话可以参考 src/rules/ 目录下的现成规则实现目录解析和正文解析两个方法再在路由里登记域名就能贡献一个新站。打开目录页按下右上角那个图标挑一本你最怕它消失的书打开它的目录页点上右上角的下载图标——你的第一座离线书库就从这一单开始了。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表