知乎抓取.SKILL
知乎收藏夹与文章批量抓取工具
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:知乎抓取.SKILL。 它的用途是:知乎收藏夹与文章批量抓取工具 完整的 Skill 内容见:https://321skill.com/skills/知乎抓取-skill-x-5/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'抓取我的知乎收藏夹“AI学习”中的所有文章,保存到本地并导出为Markdown格式,开启断点续传。' 它会自动验证Cookie,遍历收藏夹,下载每篇文章的正文和图片,若中途中断则下次从断点继续,最后将所有文件按标题组织到文件夹中,并生成索引文件。
介绍
本工具解决知乎收藏夹和文章内容难以批量导出、本地化保存的问题。知乎官方未提供有效的批量导出接口,手动复制效率极低,且长期收藏的内容容易因链接失效或账号变动而丢失。该Skill通过API优先、Playwright降级的多级策略,配合Cookie持久化与保活机制,确保稳定抓取,并支持断点续传,避免重复下载。
使用方式简单:配置好知乎Cookie后,指定收藏夹URL或文章列表,即可自动抓取正文、图片、元数据。支持批量操作,可设置断点续传,进度实时可见。抓取结果可选择直接写入本地文件夹或自动导入Obsidian知识库,方便后续整理和检索。
适合需要长期保存知乎优质内容的内容创作者、学术研究者、数据分析师,以及希望将知乎资料纳入个人知识管理系统的用户。尤其适合那些有大量收藏夹和文章需要系统化归档的人群。
建议首次使用时先测试小规模抓取,确认Cookie有效性和降级策略是否触发。注意抓取频率不宜过高,以免触发知乎反爬机制。图片下载会占用较多磁盘空间,建议定期清理或设置压缩选项。
核心特点
相比单一API抓取,本工具实现了API/Playwright多级降级机制,当API受限时自动降级到浏览器自动化,并内置Cookie持久化与保活,确保长期稳定抓取,同时支持断点续传和可选Obsidian写入。
注意事项
不适合需要实时抓取频繁更新的知乎动态内容,主要针对收藏夹和文章正文,且需依赖Playwright运行环境(如无头浏览器)。
常见问题
如何获取知乎Cookie?
通过浏览器开发者工具(F12)的Application面板找到zhihu.com的Cookie,粘贴到配置文件中即可。建议使用长期有效的Cookie。
支持导出到哪些格式?
支持Markdown格式导出,图片自动下载并本地引用,可选直接写入Obsidian vault或本地文件夹。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/知乎抓取-skill-x-5/raw/index.md 读取 知乎抓取.SKILL 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/知乎抓取-skill-x-5/raw/index.md(查看排版版本)