知乎抓取.SKILL
知乎收藏夹与文章批量抓取工具
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:知乎抓取.SKILL。 它的用途是:知乎收藏夹与文章批量抓取工具 完整的 Skill 内容见:https://321skill.com/skills/知乎抓取-skill-x/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
‘帮我抓取知乎收藏夹‘投资理财’下的所有文章,保存为Markdown并导入Obsidian。’ 它会自动读取配置,启动多级抓取流程,先尝试API获取列表,若失败则降级到Playwright模拟浏览器,最终将文章正文和图片保存到本地,并生成Obsidian可识别的格式。
介绍
该工具解决从知乎批量抓取收藏夹和文章内容的问题,支持正文、图片、元数据的一站式获取。它采用 API/Playwright 多级降级策略,能够在反爬机制下稳定运行,并内置 Cookie 持久化与保活机制,避免频繁登录。此外,还支持断点续传,适合长时间大规模抓取任务。
使用方式简单:配置好知乎 Cookie 后,运行脚本即可自动抓取指定收藏夹或文章列表,结果可保存为本地文件或直接写入 Obsidian 笔记库。工具会自动处理网络异常、重试和断点恢复,用户只需关注数据本身。
适合内容创作者、学术研究者、数据分析师等需要批量采集知乎优质内容的人群。例如,研究者可以快速收集某话题下的所有回答用于分析,创作者可以存档自己的收藏夹方便后续整理,数据分析师可以获取文章数据集进行 NLP 处理。
建议使用前仔细阅读 README 中的 Cookie 获取方法,确保网络环境稳定。抓取时请遵守知乎用户协议,合理控制频率,避免对服务器造成压力。该工具主要用于个人学习与研究,不应用于商业爬取或大规模数据滥用。
核心特点
与普通知乎爬虫相比,本工具具备 API/Playwright 多级降级策略,可自动切换请求方式保证高可用;同时内置 Cookie 持久化与保活,以及断点续传功能,适合长期、大批量抓取任务,并支持直接导出到 Obsidian 知识库。
注意事项
不适用于需要实时抓取或抓取频率极高的场景,且依赖知乎 Cookie 登录状态,若账号被限制则无法使用。
常见问题
如何获取知乎 Cookie?
请参考 README 中的说明,登录知乎后通过浏览器开发者工具复制 Cookie 字符串,填入配置文件中。
支持抓取知乎专栏文章吗?
当前主要支持收藏夹和文章内容,专栏抓取可能需要额外配置,请查看 README 中支持的 URL 格式。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/知乎抓取-skill-x/raw/index.md 读取 知乎抓取.SKILL 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/知乎抓取-skill-x/raw/index.md(查看排版版本)