ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

小说下载器零门槛指南:3个技巧把网页小说一键变成离线TXT与EPUB

小说下载器零门槛指南:3个技巧把网页小说一键变成离线TXT与EPUB 小说下载器零门槛指南3个技巧把网页小说一键变成离线TXT与EPUB【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader凌晨一点你追更的那本冷门小说刚推进到最精彩的部分手指习惯性地按下刷新——屏幕上却弹出一个刺眼的 404。没有转载、没有备份几十万字的作品一夜之间从互联网上蒸发。这种书突然没了的痛追更党几乎人人都经历过。而小说下载器 novel-downloader正是为对抗这种无力感而生的开源油猴脚本它能把网页小说一键解析成离线 TXT 与 EPUB让作品稳稳住进你的硬盘。三十秒速览它是什么、解决什么、适合谁它是什么一个跑在浏览器里的用户脚本油猴脚本打开小说目录页就能用无需安装任何客户端。解决什么把 200 小说网站的章节自动整理成规整的 TXT 和 EPUB 文件断网也能读。适合谁追更党、收藏党以及所有被全书消失吓怕过的人。一句话总结网页小说一键下载离线阅读自由。下载器在目录页实时解析章节列表配合控制台日志整个抓取过程一目了然 从零到一首次安装与首次下载的完整流程一个新手的完整动线其实只有三件事装好壳、装好脚本、点一下图标。前置准备给浏览器装一个脚本管理器。Tampermonkey、Violentmonkey、Greasemonkey 三选一即可去各自的扩展商店搜索安装一分钟搞定。接着获取脚本本体想从源码构建的话先克隆 https://gitcode.com/gh_mirrors/no/novel-downloader 到本地依次执行yarn install和yarn run build把生成的dist/bundle.user.js拖进脚本管理器不想折腾的直接用项目发布页的现成脚本。关键动作打开目录页点击右上角的下载图标。脚本启动后访问任意受支持的小说网站打开书籍目录页右上角就会浮现下载图标。点击它任务开始。这里有个贴心的小设计脚本会播放一段无声音频防止浏览器因为太安静而被系统休眠——这是很多下载工具容易忽略的细节。下载进度看右下角的进度条即可想看细节就按 F12 打开控制台。预期结果几分钟到几十分钟后浏览器自动下载两个文件——一个 TXT、一个 EPUB。TXT 用记事本或任意阅读软件打开EPUB 交给专属阅读器排版、目录、章节结构全都在。下载后的小说正文保留了完整章节与段落结构和网页阅读体验几乎一致 解锁进阶能力把下载器调教成你想要的样子用得越久你会发现这个工具真正值钱的地方在于可定制。只下载你想读的章节。场景一本连载 800 章的书你只关心前 100 章或者只想重温第一卷。按 F12 在控制台定义一个chapterFilter函数即可return chapter.chapterNumber 100;只下前 100 章return chapter.sectionNumber 1;只下第一卷还能用chapterName.includes(武器)只保留标题里带武器的章节。自定义输出排版。场景你不喜欢默认的章节命名想要第 12 章 标题这种格式或者希望 TXT 正文每段首行缩进两格。在window下挂一个saveOptions对象就能全权接管章节命名、文本样式甚至排序逻辑。配合用户脚本自动注入这些偏好可以永久生效每次下载都自动按你的习惯来。破解图片防爬。场景西瓜书屋这类网站把文字渲染成图片普通抓取根本拿不到文字。下载器为此内置了三层解码——先按图片文件名映射直接匹配文字最快匹配不到就下载图片计算哈希再匹配前两招都失灵时才动用 PaddleOCR 模型识别最准但最慢。三层层层兜底基本没有读不出来的图。导出的 TXT 在编辑器里打开章节标题与正文段落层次分明可直接用于二次整理 新手最容易踩的3个坑与补救方案坑一打开书籍页却没有下载图标。原因多是网站是单页应用SPA内容由 JS 动态加载脚本没抓到时机。对策很简单按 F5 刷新当前页面等图标出现再点击八成能解决。坑二付费章节一个都没下下来。这不是 bug——脚本会刻意跳过未登录、未购买的 VIP 章节。先登录对应网站账号并确认已购买相应章节部分网站如晋江文学城还需要在设置里填入登录 token才能顺利下载。坑三文档里出现乱码或诡异字符。常见于晋江、番茄等使用了自定义字体混淆的网站。打开设置里的测试视图查看日志留意以[jjwxc-font]或[fanqie-font]开头的提示按提示完成字体匹配操作乱码即可消除。 走进幕后200多个网站是怎么听懂的一个脚本要同时服务 200 结构迥异的网站靠的是模块化规则设计。打开项目的src/rules/目录你会看到每个网站都有专属规则文件按单页 / 双页 / 多页索引 / 特殊站点等类型分门别类存放。新站点接入时只需继承基础类、实现bookParse和chapterParse两个方法再把匹配规则登记进路由一次构建即可生效。解析、清洗、存储彼此解耦所以才能做到加一个新站不动旧逻辑。如果你恰好懂 TypeScript这个项目本身就是一个极佳的开源练手素材。 尾声把喜欢的作品留在身边回到开头那个凌晨——下次再遇到心动的冷门作品别再赌它会不会消失。装好脚本、打开目录页、点一下下载图标几十万字的作品就从此住进你的硬盘随时可读、永不 404。现在就动手克隆 https://gitcode.com/gh_mirrors/no/novel-downloader 构建一份属于你自己的小说下载器把每一本值得珍藏的书都收进自己的数字图书馆。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表