小说规则下载器依靠自定义解析规则抓取网页小说,内置大量站点模板,新手可直接套用快速采集章节内容。支持多线程任务调度、断点续传,自动清理页面广告垃圾文本,能够规整章节顺序,导出 TXT、EPUB 电子书文件,方便爱好者批量保存网文,打造专属本地离线小说资料库。
软件功能
导入小说目录链接后,借助预设模板或自行编写提取规则,识别章节标题与正文内容完成批量采集。
支持同时建立多个下载任务,可自由调整并发线程数量,任务中断后支持断点续传避免重复抓取页面。
内置文本清洗功能,自动剔除网页广告、弹窗文字、多余换行符号,得到干净整洁的小说正文内容。
提供章节排序、查重、删减无效条目功能,修正错乱序号,防止出现章节重复、顺序颠倒等问题。
采集完成可整合输出 TXT 纯文本或 EPUB 格式电子书,支持自定义封面、目录结构适配各类阅读器。
附带网页源码分析工具,辅助调试规则表达式,方便为未收录的小众小说站点搭建专属解析方案。
软件特点
规则体系灵活可拓展,已有模板可直接使用,有基础的使用者能够自行新增站点解析方案拓展适用范围。
任务信息持久保存,关闭程序后不会丢失下载进度,再次启动即可继续处理未完成的小说采集任务。
全部网页访问与文本处理在本地运行,不会强制推送广告,程序精简,长时间批量下载不易发生崩溃。
规则文件支持导入与导出,方便爱好者互相分享适配方案,不用重复花费时间调试相同网站抓取逻辑。
抓取间隔、请求头参数均可自定义设置,合理调节访问节奏,降低站点限制访问、屏蔽 IP 的概率。
更新日志
v4.2.3
分析目录页时,添加指定源码功能,针对部分对使用重定向防爬虫机制的网站,可在浏览器中获取目录页的源代码,并粘贴到工具中进行分析提取章节链接(无法读取目录页源代时用);
优化请求头数据包,适用部分需要添加请头头数据的网站。
修正原章节标题中出现单引号后,无法生成任务的 BUG

请登录后查看评论内容