pi-fetch-markdown
抓取任意网页并转换为干净的Markdown格式内容
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:pi-fetch-markdown。 它的用途是:抓取任意网页并转换为干净的Markdown格式内容 完整的 Skill 内容见:https://321skill.com/skills/pi-fetch-markdown/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'帮我抓取这篇技术博客转成Markdown:https://example.com/blog',它会自动解析网页,过滤广告、评论区等冗余内容,输出排版规整的Markdown正文。
对AI说:'把这个官方文档网页转成干净的Markdown',它会优先选择适配的解析通道抓取,若失败会自动切换备用通道重试。
介绍
日常获取网页内容时,常被广告、侧边栏、弹窗、评论区等冗余元素干扰,手动复制粘贴不仅容易出现格式错乱,还需花费大量时间清理排版,想要提取纯净的网页文本用于后续处理往往效率极低。 它依托Cloudflare内容协商或Jina Reader两种能力实现网页内容抓取,安装完成后只需向AI传入目标网页的公开URL,就能自动完成页面解析、冗余内容过滤、格式转换全流程,直接输出排版规整的Markdown格式内容,无需额外手动调整格式。 适合需要频繁采集网页内容的内容创作者、技术开发者、资料整理人员,以及需要将网页内容导入AI工具做后续总结、分析、改写的各类用户,能大幅减少内容预处理的时间成本。 使用时请确保传入的是可公开访问的网页URL,若遇到部分反爬机制严格的站点,可尝试切换解析通道提升抓取成功率,抓取后的内容请注意遵守对应站点的版权规定,不可未经授权随意商用传播。
核心特点
它同时支持Cloudflare内容协商与Jina Reader两种解析通道,相比同类工具可适配更多站点,输出的Markdown冗余过滤更彻底、格式整洁度更高。
注意事项
不适合抓取需要登录鉴权、有强反爬机制或非公开的内网网页内容。
常见问题
抓取网页时会保留原页面的图片吗?
会保留原页面可公开访问的图片链接,以Markdown图片格式嵌入输出内容。
可以抓取需要登录才能查看的网页吗?
暂不支持,仅能抓取无需登录即可公开访问的网页内容。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/pi-fetch-markdown/raw/index.md 读取 pi-fetch-markdown 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/pi-fetch-markdown/raw/index.md(查看排版版本)