知乎文章抓取与 Obsidian 同步
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_9610c87f/zhihu-fetch-skill。
技能介绍
解决什么问题
知乎内容分散在收藏夹、个人动态和正文页里,直接复制会丢失结构、图片引用和本地检索入口。zhihu-fetch-skill 面向需要把指定收藏夹或点赞/收藏历史沉淀为本地 Markdown 的场景,重点处理列表获取、正文抓取、图片落盘和后续知识库写入。
它如何工作
技能按脚本分工:先用列表脚本输出收藏夹 JSON,再用批量脚本抓取文章 Markdown、下载图片并维护 _progress.json;遇到 Cookie 失效、API 摘要不完整或 Headless 被识别时,可在 API、DOM、Stealth 和交互式浏览器之间降级。写入 Obsidian 时会识别 Vault、按已有分类或关键词归类,并保留 title、author、url、voteup 等 frontmatter。个人历史流程会保存互动元数据,并按 URL 去重更新,减少重复导入。
适用边界与注意点
它不是通用网页抓取器,而是围绕 Zhihu 登录态、z_c0 Cookie、反爬提示和 Obsidian 目录约定设计。遇到验证码、页面安全验证或连续环境失败时,需要人工登录或调整网络环境;图片可能因 Referer、过期链接失败,正文仍可能保留原 URL。处理个人数据与版权内容时应遵守相关规则。
使用场景
- 批量导出知乎收藏夹文章为含 frontmatter 的 Markdown,并下载图片到本地 images 目录。
- 批量抓取中断或 Cookie 过期后,凭 _progress.json 恢复进度,继续抓取剩余文章。
- 将知乎收藏文章分类写入 Obsidian Vault,按 URL 去重更新,避免重复导入。
- 抓取个人主页点赞与收藏历史,保留互动元数据,并按 URL 更新本地笔记。
适合人员
- 需要把长期关注的知乎收藏夹沉淀成本地 Markdown 笔记的知识管理用户
- 要把个人点赞与收藏历史整理成可检索 Obsidian 笔记的独立研究者
- 负责维护行业资料库、需要定期同步知乎文章与图片的资料运营
- 排查 Cookie 失效、反爬提示和浏览器自动化降级的数据工程师