@zeldrisho/pi-web-fetch

安全网页抓取并提取Markdown的Pi扩展

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:@zeldrisho/pi-web-fetch。
它的用途是:安全网页抓取并提取Markdown的Pi扩展
完整的 Skill 内容见:https://321skill.com/skills/zeldrisho-pi-web-fetch-zeldrisho/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'帮我抓取 https://docs.example.com/guide 的内容,以 Markdown 格式返回,只保留正文部分。' 它会调用 @zeldrisho/pi-web-fetch 扩展,安全地请求该 URL,自动过滤导航、广告等无关元素,返回整洁的 Markdown 文本,方便你直接用于知识库或笔记。

介绍

在开发智能体或自动化工作流时,经常需要从公开网页中提取结构化文本内容,但传统的网页抓取工具往往存在安全风险(如执行恶意脚本、泄露敏感数据)或输出格式混乱。@zeldrisho/pi-web-fetch 是一个专为 Pi 平台设计的扩展,它提供安全、有界的网页抓取能力,自动将 HTML 页面转换为整洁的 Markdown 文档,让你在获取信息的同时保持对数据源和请求范围的严格控制。

使用方式非常简单:在 Pi 环境中安装该扩展后,只需提供目标网页 URL,扩展便会自动处理请求、解析内容并返回 Markdown 格式的文本。你还可以通过参数限制抓取深度、超时时间和最大内容大小,避免意外访问内部资源或触发反爬机制。整个过程无需关心底层 HTTP 请求细节,也无需手动清洗 HTML 标签。

这个扩展特别适合智能体开发者、全栈工程师以及需要频繁从网页采集资料的内容创作者。无论是为 AI 模型准备训练数据、构建知识库,还是将在线文档快速转换为本地笔记,它都能显著提升效率。同时,由于它内置了安全边界和请求限制,也适合在需要合规抓取公开信息的场景下使用。

使用前建议确认目标网站允许爬取(遵守 robots.txt 协议),并注意该扩展仅适用于公开网页,无法处理需要登录认证或大量 JavaScript 渲染的页面。对于简单的静态或半静态网页,它是最佳选择之一。合理设置超时和大小限制可以避免资源浪费,也更能保护你的代理环境。

核心特点

与通用网页抓取工具相比,@zeldrisho/pi-web-fetch 深度集成 Pi 生态,自动完成 HTML-to-Markdown 转换,并内置安全边界(如限制请求范围、超时和大小),防止抓取行为意外扩散到内网或消耗过多资源。

注意事项

不适合需要登录认证、大量 JavaScript 渲染或动态加载内容的复杂网页,也无法处理非公开内网资源。

常见问题

能抓取需要登录的页面吗?

不能,该扩展仅支持公开网页,无法处理 Cookie 或认证信息。

输出格式只有 Markdown 吗?

是的,扩展自动将 HTML 转换为 Markdown 文本,不支持直接输出原始 HTML 或其他格式。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/zeldrisho-pi-web-fetch-zeldrisho/raw/index.md 读取 @zeldrisho/pi-web-fetch 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。