Claw Web Fetch

将网页、GitHub README和Reddit帖子抓取为Markdown格式。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Claw Web Fetch。
它的用途是:将网页、GitHub README和Reddit帖子抓取为Markdown格式。
完整的 Skill 内容见:https://321skill.com/skills/claw-web-fetch-x-7/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'帮我把这个GitHub仓库的README抓取成Markdown文件',它会调用Claw Web Fetch,执行相应的命令,将指定URL的README内容下载并保存为格式清晰的Markdown文档。或者,

对AI说:'我想把Reddit上关于AI的讨论帖保存下来分析',它同样可以快速抓取整个帖子线程并转换为结构化的Markdown文本。

介绍

Claw Web Fetch 是一个基于 npm CLI 工具 clawfetch 的轻量级封装,旨在简化网页内容的获取与格式化过程。它解决了开发者和内容创作者需要从网页、GitHub 仓库或 Reddit 讨论中快速提取并整理结构化文本信息的痛点。

使用起来非常直接,通过简单的命令行指令,即可将目标URL的内容抓取下来,并自动转换为清晰易读的Markdown格式。这省去了手动复制粘贴、处理HTML标签或调整格式的繁琐步骤,让信息收集工作流更加高效。

它非常适合需要频繁进行网络信息收集、内容归档或竞品分析的各类用户。无论是前端开发者需要参考其他项目的README结构,还是内容创作者需要整理网络素材,或是学术研究者需要收集特定主题的讨论,都能从中受益。

建议在使用前确保目标网站允许爬取,并注意遵守 robots.txt 协议。对于需要登录或具有复杂交互的页面,此工具可能无法直接处理,建议结合其他方法或工具。

核心特点

作为 `clawfetch` CLI的封装,它直接聚焦于将网页、GitHub README和Reddit线程这三种常见且格式各异的来源统一转换为Markdown,提供了开箱即用的简洁性,无需用户自行处理不同站点的解析规则。

注意事项

不适合抓取需要复杂交互(如登录、点击)的动态网页内容,或处理有严格反爬机制的网站。

常见问题

Claw Web Fetch 能抓取需要登录的页面吗?

不能,它主要用于抓取公开可访问的静态网页内容。

抓取的Markdown格式准确吗?

对于标准网页、GitHub README和Reddit,格式转换效果良好,但复杂网页的样式可能无法完美保留。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/claw-web-fetch-x-7/raw/index.md 读取 Claw Web Fetch 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。