web-content-fetcher

轻量级网页正文提取工具,一键转Markdown。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:web-content-fetcher。
它的用途是:轻量级网页正文提取工具,一键转Markdown。
完整的 Skill 内容见:https://321skill.com/skills/web-content-fetcher/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“帮我提取一下 https://sspai.com/post/73145 这篇文章的正文。” 它会自动调用该Skill,运行抓取脚本,并在几秒内将网页的标题、正文、图片链接等以清晰的Markdown格式呈现给你,方便你直接复制保存或进一步总结。

介绍

Web Content Fetcher 是一个专为AI Agent设计的Skill,旨在解决从网页中快速、准确地提取核心正文内容并转换为干净Markdown格式的痛点。用户只需提供一个URL,它就能自动剥离广告、导航栏等无关元素,保留标题、链接、图片、列表和代码块等关键信息,极大地方便了内容的二次整理、阅读或分析。

使用方式非常直接。在支持此Skill的AI平台(如Claude、Cursor)中,用户可以直接发送一个网页链接,或说出类似“帮我读一下这篇文章”的指令。Skill内部会智能选择最优提取策略:优先使用内置的Scrapling脚本(支持快速模式和隐身模式自动切换),若失败则回退到Jina Reader API,确保高成功率。

这个Skill非常适合需要频繁收集网络信息进行研究的学者、需要快速整理竞品或行业资讯的运营/市场人员、以及任何希望将网页内容存档或纳入知识库的普通用户。它让信息获取变得像复制粘贴一样简单。

与同类网页抓取工具相比,它的核心优势在于深度集成到AI工作流中,实现了“对话即操作”。它不像浏览器插件需要手动点击,也不像通用爬虫库需要编写代码。它针对中文互联网环境(如微信公众号、知乎专栏)做了特别优化,并内置了域名路由表,能智能判断使用何种抓取模式,在易用性和成功率上取得了良好平衡。

核心特点

深度集成AI对话流,用户无需离开聊天界面即可完成抓取;内置针对微信公众号、知乎等中文平台的优化路由和隐身抓取模式,成功率更高。

注意事项

不适用于需要登录才能访问的页面、纯视频/音频页面,以及Jina Reader无法处理的特定平台(如部分反爬严格的站点)。

常见问题

能抓取微信公众号文章吗?

可以,专门针对 mp.weixin.qq.com 域名优化,使用隐身模式抓取。

提取速度怎么样?

普通静态页面1-3秒,复杂JS页面(隐身模式)需要5-15秒。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/web-content-fetcher/raw/index.md 读取 web-content-fetcher 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。