notcrawl

将Notion工作区数据镜像到本地SQLite和Markdown,实现离线搜索与查询。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:notcrawl。
它的用途是:将Notion工作区数据镜像到本地SQLite和Markdown,实现离线搜索与查询。
完整的 Skill 内容见:https://321skill.com/skills/notcrawl/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“帮我把Notion里关于‘项目复盘’的所有页面和数据库同步到本地,并导出成Markdown文件。”,它会引导你使用 `notcrawl sync --source api` 和 `notcrawl export-md` 命令,将指定内容完整抓取并生成本地文档。或者

对AI说:“我想离线快速查找上周记在Notion里的会议纪要关键词。”,它会建议你运行 `notcrawl sync --source desktop` 快速建立本地缓存,然后使用 `notcrawl search "会议纪要"` 进行即时全文检索。

介绍

notcrawl 解决了用户对Notion数据的强依赖和在线访问限制问题。它通过读取本地Notion桌面缓存或调用官方API,将页面、数据库、评论等数据完整抓取并存储到本地SQLite数据库中,同时生成规范化的Markdown文件。这使得用户可以在完全离线的情况下,对Notion内容进行全文搜索、SQL查询、版本差异对比和分享。

使用notcrawl非常简单。安装后,通过notcrawl init初始化配置,然后使用notcrawl sync --source desktop(或api)即可开始同步数据。之后,你可以使用notcrawl search进行全文检索,用notcrawl tui在终端浏览,或用notcrawl export-md导出Markdown进行编辑和分享。它还支持通过git share模式发布数据快照,供其他设备订阅更新。

这个工具非常适合需要频繁查阅、分析或备份Notion内容,但又希望摆脱网络和Notion界面限制的用户。例如,内容创作者可以离线整理素材库,项目经理可以分析任务数据库,研究者可以备份文献笔记并进行本地检索。

使用建议:首次使用推荐从desktop源开始,因为它无需API令牌且速度快。注意,desktop源是只读快照,无法获取实时更新。对于需要最新数据或桌面缓存不完整的页面,可以结合使用apinotion-mcp源进行补充抓取。定期运行notcrawl maintain可以优化数据库性能。

核心特点

与仅提供API封装或简单导出的工具不同,notcrawl 提供了三种互补的数据摄入路径(本地缓存、官方API、MCP修复),并以SQLite作为权威存储,实现了数据的可查询、可版本化和可离线化,而非一次性导出。其“git share”模式使得数据快照可以在无Notion凭证的设备间安全同步,这是其独特的数据分发能力。

注意事项

不适合需要实时双向同步或通过Notion UI直接编辑本地数据的场景,它是一个只读的归档与查询工具。

常见问题

notcrawl会修改我Notion里的数据吗?

不会。notcrawl是只读的,它只会从Notion抓取数据到本地,不会对云端Notion内容做任何修改。

使用desktop源同步需要网络吗?

不需要。desktop源直接读取你电脑上Notion桌面应用缓存的本地数据,完全离线工作。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/notcrawl/raw/index.md 读取 notcrawl 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。