pi-surf
从Pi代理中获取干净网页内容
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:pi-surf。 它的用途是:从Pi代理中获取干净网页内容 完整的 Skill 内容见:https://321skill.com/skills/pi-surf/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'研究如何配置RDS Proxy与PostgreSQL和Django,重点是连接池设置和会话固定',它会先调用web_search搜索相关文章,然后让侦察子代理抓取并分析找到的页面,最后只返回连接池配置参数、会话固定原理等关键信息,忽略导航和广告。或者直接说:'获取 https://example.com/api 的文档内容,只保留main区域',它会使用fetch_url配合CSS选择器'#main'得到干净的Markdown。
介绍
这个Skill解决了在AI编码代理中获取网页内容时,大量无关噪音(导航、广告、侧边栏)污染上下文的问题。实际开发中,当你需要参考文档、抓取竞品信息或搜索技术方案时,原始HTML往往包含大量冗余元素,不仅浪费Token,还容易让AI误解关键信息。
使用方式很简单,你只需要在Pi代理中安装该Skill后,通过自然语言指令即可调用三个工具:fetch_url用于获取任意URL并自动转换为干净的Markdown(支持CSS选择器锁定特定区域);web_search通过可插拔的搜索引擎(如Brave Search)返回标题、URL和摘要;web_research则是旗舰功能,它会自动启动一个轻量级侦察子代理,先搜索、再抓取、最后分析,只将最相关的结果返回给你,所有噪音都留在子代理的上下文中。
它非常适合需要频繁获取网页信息来辅助编码或研究的团队或个人,尤其是那些已经使用Pi作为编码代理的用户。无论是查阅API文档、搜索技术方案、还是进行竞品调研,都能显著减少手动清理内容的精力,同时降低AI对话的Token消耗。
建议在需要快速获取网页核心内容时统一使用此工具,尤其是当目标网页包含大量广告或导航栏时。需要注意的是,它主要依赖Mozilla Readability进行内容提取,对于某些动态加载或JavaScript重度渲染的页面,可能无法完整获取所有内容,此时可以尝试指定CSS选择器来定位目标区域。
常见问题
如何配置Brave搜索?
设置环境变量 BRAVE_API_KEY,免费版每月2000次查询,申请地址:brave.com/search/api。
支持自定义搜索提供商吗?
支持,可通过事件总线注册、文件发现(~/.pi/agent/search-providers/)或设置对应环境变量自动激活。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/pi-surf/raw/index.md 读取 pi-surf 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/pi-surf/raw/index.md(查看排版版本)