@dmallory42/pi-read-url
将公开网页URL提取为干净Markdown的Pi扩展
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:@dmallory42/pi-read-url。 它的用途是:将公开网页URL提取为干净Markdown的Pi扩展 完整的 Skill 内容见:https://321skill.com/skills/dmallory42-pi-read-url/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“帮我把这个公开网页https://example.com/tech-post的内容转成干净的Markdown”,它会自动拉取页面内容,清理广告、导航栏等无关元素,输出排版规整的Markdown文本。你也可以指定需要排除的页面板块,定制输出的内容结构。
介绍
日常需要将公开网页内容转换为Markdown格式时,常遇到转换结果夹带广告、导航栏等冗余内容,依赖第三方在线转换服务存在内容泄露风险,或是配置复杂导致使用门槛高的问题,该扩展针对性解决了上述痛点。 它依托系统自带的网络请求能力拉取公开HTML页面内容,无需复杂的前置配置,安装完成后只需传入目标公开网页的URL,即可自动完成内容解析、无效标签清理,输出排版规整的纯净Markdown内容。 适合经常需要采集公开网页资料、整理技术博客内容、归档文档素材的开发者、内容创作者、资料运营人员,以及在Pi生态下需要快速获取网页结构化内容的AI工具使用者。 使用时请确认目标页面为无需登录鉴权的公开可访问资源,若站点设置了严格的反爬机制可能出现拉取失败的情况,建议优先用于公开技术文档、个人博客、资讯文章等无强反爬的页面场景。
核心特点
和同类网页转Markdown工具相比,它直接调用系统原生curl实现内容拉取,不依赖第三方在线转换服务或无头浏览器,本地执行无数据外传风险,输出的Markdown冗余度更低。
注意事项
仅支持提取无需登录鉴权、无强反爬机制的公开HTML页面,无法处理需要身份验证或动态渲染的复杂页面。
常见问题
该工具可以提取需要登录才能查看的网页内容吗?
不可以,仅支持无需登录鉴权的公开可访问HTML页面。
转换后的Markdown会保留网页的全部样式和元素吗?
不会,会自动清理广告、导航等冗余元素,仅保留核心内容的结构化Markdown。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/dmallory42-pi-read-url/raw/index.md 读取 @dmallory42/pi-read-url 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/dmallory42-pi-read-url/raw/index.md(查看排版版本)