web-content-fetcher
轻量级网页正文提取工具,一键转Markdown。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:web-content-fetcher。 它的用途是:轻量级网页正文提取工具,一键转Markdown。 完整的 Skill 内容见:https://321skill.com/skills/web-content-fetcher/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“帮我提取一下 https://sspai.com/post/73145 这篇文章的正文。” 它会自动调用该Skill,运行抓取脚本,并在几秒内将网页的标题、正文、图片链接等以清晰的Markdown格式呈现给你,方便你直接复制保存或进一步总结。
介绍
Web Content Fetcher 是一个专为AI Agent设计的Skill,旨在解决从网页中快速、准确地提取核心正文内容并转换为干净Markdown格式的痛点。用户只需提供一个URL,它就能自动剥离广告、导航栏等无关元素,保留标题、链接、图片、列表和代码块等关键信息,极大地方便了内容的二次整理、阅读或分析。
使用方式非常直接。在支持此Skill的AI平台(如Claude、Cursor)中,用户可以直接发送一个网页链接,或说出类似“帮我读一下这篇文章”的指令。Skill内部会智能选择最优提取策略:优先使用内置的Scrapling脚本(支持快速模式和隐身模式自动切换),若失败则回退到Jina Reader API,确保高成功率。
这个Skill非常适合需要频繁收集网络信息进行研究的学者、需要快速整理竞品或行业资讯的运营/市场人员、以及任何希望将网页内容存档或纳入知识库的普通用户。它让信息获取变得像复制粘贴一样简单。
与同类网页抓取工具相比,它的核心优势在于深度集成到AI工作流中,实现了“对话即操作”。它不像浏览器插件需要手动点击,也不像通用爬虫库需要编写代码。它针对中文互联网环境(如微信公众号、知乎专栏)做了特别优化,并内置了域名路由表,能智能判断使用何种抓取模式,在易用性和成功率上取得了良好平衡。
核心特点
深度集成AI对话流,用户无需离开聊天界面即可完成抓取;内置针对微信公众号、知乎等中文平台的优化路由和隐身抓取模式,成功率更高。
注意事项
不适用于需要登录才能访问的页面、纯视频/音频页面,以及Jina Reader无法处理的特定平台(如部分反爬严格的站点)。
常见问题
能抓取微信公众号文章吗?
可以,专门针对 mp.weixin.qq.com 域名优化,使用隐身模式抓取。
提取速度怎么样?
普通静态页面1-3秒,复杂JS页面(隐身模式)需要5-15秒。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/web-content-fetcher/raw/index.md 读取 web-content-fetcher 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/web-content-fetcher/raw/index.md(查看排版版本)