知乎抓取.SKILL
知乎收藏夹与文章批量抓取工具
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:知乎抓取.SKILL。 它的用途是:知乎收藏夹与文章批量抓取工具 完整的 Skill 内容见:https://321skill.com/skills/zhihu-collection-scraper-5/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'抓取我知乎收藏夹'数据科学'中的所有文章,保存到 Obsidian 的'知识库/知乎'目录下,包括图片。' 它会自动配置 Cookie、启动抓取流并显示进度,完成后通知你。
介绍
你是否需要从知乎批量导出收藏夹或文章内容,用于个人知识库、竞品分析或学术研究?这个 Skill 帮你解决手动复制粘贴的繁琐问题。它通过 API 和 Playwright 多级降级策略自动抓取,支持 Cookie 持久化与保活,确保登录态稳定;可批量下载正文和图片,支持断点续传,避免重复劳动;还能可选地将内容直接写入 Obsidian,方便你管理和沉淀知识。
使用非常简单:配置好你的知乎 Cookie 和收藏夹或文章链接,AI 会自动启动抓取流程。你可以选择仅抓取文本、同时下载图片,或指定输出到 Obsidian 的 vault 路径。抓取过程中会实时显示进度,遇到失败会自动重试并断点续传,即使中断也能下次继续。
这个 Skill 适合需要大量获取知乎内容的内容创作者、学术研究者和数据分析师。比如,你可以用它批量抓取某个话题下的所有高赞回答,用于内容分析;或者备份自己的收藏夹,避免内容被删除;也可以将知乎上的优质文章导入 Obsidian 构建个人知识库。
使用前请确保已安装 Playwright 浏览器驱动,并注意遵守知乎的使用条款,不要频繁请求以免触发反爬机制。建议在抓取大量数据时设置合理的请求间隔,并定期检查 Cookie 是否过期。
核心特点
相比同类工具,它支持 API/Playwright 多级降级自动切换、Cookie 持久化与保活,且具备断点续传和可选 Obsidian 写入功能,综合解决了知乎抓取中的稳定性、登录态维护和知识管理集成难题。
注意事项
不适合抓取需要登录才能访问的私密内容,且受限于知乎反爬机制,如果请求过于频繁可能被封禁。
常见问题
如何配置知乎 Cookie?
在浏览器登录知乎后,通过开发者工具获取 Cookie 字符串,粘贴到配置文件中即可。
如何启用 Obsidian 导出?
在配置中设置 Obsidian vault 路径和输出文件夹,抓取后的内容会自动生成 Markdown 文件并保存到指定位置。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/zhihu-collection-scraper-5/raw/index.md 读取 知乎抓取.SKILL 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/zhihu-collection-scraper-5/raw/index.md(查看排版版本)