知乎抓取.SKILL
知乎收藏夹与文章批量抓取工具
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:知乎抓取.SKILL。 它的用途是:知乎收藏夹与文章批量抓取工具 完整的 Skill 内容见:https://321skill.com/skills/知乎抓取-skill-x-6/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请帮我抓取知乎收藏夹https://www.zhihu.com/collection/123456789中的所有文章内容,保存为Markdown并导入Obsidian。' 它会自动使用API优先抓取,若遇到反爬则降级为Playwright,同时保持Cookie有效,批量下载配图,断点续传确保完整,最后将每篇文章作为独立笔记写入Obsidian。
介绍
本工具主要解决从知乎平台批量抓取收藏夹和文章内容时遇到的效率低下、反爬限制、数据碎片化等问题。通过API优先、Playwright降级的混合策略,能够自动切换抓取方式,确保在严格的反爬机制下也能稳定获取数据,同时支持Cookie持久化与保活,避免频繁登录。
使用方法简单:配置好知乎Cookie后,指定收藏夹链接或文章URL,即可一键启动抓取。工具支持批量下载正文和图片,具备断点续传功能,可随时中断后继续。抓取结果可选择直接写入Obsidian笔记库,或导出为本地Markdown文件,方便后续整理和二次利用。
适合内容创作者、学术研究者、数据分析师等需要大量采集知乎优质内容的用户,尤其适合那些需要将分散的知乎文章系统化归档到个人知识库的场景。对于经常研究知乎热门话题、整理行业报告、或进行竞品内容分析的用户,能显著提升效率。
使用时请注意:需要提前获取有效知乎Cookie(手动登录后复制),并确保网络稳定。由于知乎反爬策略可能更新,建议定期更新工具。另外,大规模抓取可能触发账号风控,请合理控制频率,避免短时间高并发请求。
核心特点
支持API/Playwright多级降级策略自动切换,配合Cookie持久化与保活机制,以及断点续传和可选Obsidian直接写入,比同类工具更稳定、更易用。
注意事项
不适用于需要实时抓取动态渲染的复杂页面(如知乎直播、视频评论区),且依赖有效Cookie,无法绕过知乎实名认证限制。
常见问题
如何获取知乎Cookie?
在浏览器中登录知乎后,按F12打开开发者工具,在Network请求中找到任意请求头中的Cookie字段,复制全部内容即可。
支持批量下载图片吗?
支持,工具会自动识别文章中的图片链接并批量下载到本地,同时保留图片在Markdown中的引用路径。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/知乎抓取-skill-x-6/raw/index.md 读取 知乎抓取.SKILL 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/知乎抓取-skill-x-6/raw/index.md(查看排版版本)