Agent Skills
返回列表
全网网文爬虫与阅读管家

全网网文爬虫与阅读管家

生活服务 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_9d5a2a39/webnovelscraper。

技能介绍

解决的问题

很多网文工具只能收藏书名或搜索入口,真正想离线阅读时仍卡在正文获取、章节更新和格式导出之间。webnovelscraper 把这条链路拆成可操作的工程问题:从发现小说、添加追更,到爬取章节、导出 EPUB/TXT、生成 MP3 听书,都用本地文件和 SQLite 数据库保存状态。

工作方式

工具的核心路径是 add-novel、crawl、download、tts。添加时先记录书名、作者、平台与目录页 URL,不立即下载正文;爬取时先抓目录页得到章节列表,再按章节抓取正文,清洗水印、广告和导航文字后写入 ~/Novels/<书名>/chapters/。读取、导出和转语音都基于这些已落盘章节,因此可以断点续传,也能对未爬章节按需补抓。

  • 进度语义更稳:增量更新只推进到无缺口的最大章节,失败章节不会被永久跳过。
  • 性能更可用:v2.1.0 用线程池并发爬取,默认 3 线程,并保留每章礼貌延时。
  • 导出更干净:EPUB 对标题和正文做 HTML 转义,减少特殊字符导致的章节乱码。
  • 听书更稳:长章节按句子边界切分,失败时指数退避重试,并清理不完整音频。

适用边界

它对笔趣阁类聚合站的免费章节支持较好,适合个人阅读、离线整理和睡前听书。起点、番茄等 JS 渲染或会员限制较强的平台能力有限,可能需要 Playwright 或 CDP 浏览器,且默认关闭。TTS 依赖 edge-tts,国内网络可能需要代理。爬取内容应仅用于个人阅读,避免高频请求和传播。

使用场景

  • 追更多部长篇时,登记笔趣阁 URL 并分批下载未读章节,中断后重跑自动跳过已爬部分。
  • 想把网页小说放到阅读器时,爬取指定章节范围并导出带目录的 EPUB 文件。
  • 睡前不想看屏幕时,把连续章节转成 MP3,并合并成可离线播放的音频。
  • 笔趣阁域名失效时,检查可用镜像并切换,再重新爬取目标章节。

适合人员

  • 追更多部连载小说的读者,需要定期抓取新增章节并在本地阅读器中离线阅读。
  • 通勤或睡前听书的读者,希望把指定章节转成 MP3,并能处理长章节生成失败。
  • 整理个人书架的读者,需要登记书名、平台、URL,并查看追更列表与阅读统计。
  • 使用笔趣阁聚合站个人阅读的读者,需要镜像失效时切换域名并断点续传章节。