Web Content Pick MCP

网页结构化内容提取工具,支持自定义选择与爬取。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Web Content Pick MCP。
它的用途是:网页结构化内容提取工具,支持自定义选择与爬取。
完整的 Skill 内容见:https://321skill.com/skills/web-content-pick-mcp/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“帮我抓取这个新闻网站首页上所有新闻的标题和链接。”,它会调用 Web Content Pick MCP,访问你提供的网址,识别出新闻列表区域,并将提取到的标题和链接以清晰的列表形式返回给你。或者,你可以说:“提取这个电商产品页面的价格、描述和主要规格参数。”,它会精准定位这些信息并整理成结构化数据。

介绍

在信息爆炸的时代,从海量网页中精准、高效地提取所需的结构化内容是一项繁琐且耗时的任务。无论是为了内容聚合、数据分析还是知识管理,手动复制粘贴不仅效率低下,还容易出错。Web Content Pick MCP 正是为了解决这一痛点而生,它允许用户通过自定义选择器,像使用鼠标点选一样,轻松抓取网页上的特定内容,并将其转化为结构化的数据。

使用 Web Content Pick MCP 非常简单。用户只需在 AI 对话中提供目标网页的 URL,并指定想要提取的内容区域(例如,新闻标题、商品价格、文章正文等),该工具便会自动执行抓取任务,并将结果以清晰的结构化格式(如 JSON、Markdown 或纯文本)返回。整个过程无需编写复杂的爬虫代码,大大降低了技术门槛。

这款工具非常适合需要从网页批量获取信息并进行后续处理的人群。例如,内容创作者需要搜集素材,数据分析师需要采集市场数据,电商运营需要监控竞品价格,学术研究者需要整理文献信息等。它让非技术人员也能轻松实现网页数据的自动化采集。

在使用时,建议用户明确目标内容的 CSS 选择器或 XPath,这能提升抓取的准确率。同时,请注意遵守目标网站的 robots.txt 协议,尊重版权,避免高频请求对目标服务器造成压力。对于需要登录或包含大量动态加载内容的复杂网页,可能需要结合其他工具或进行额外配置。

核心特点

与同类工具相比,其核心优势在于支持高度自定义的选择器,允许用户像在浏览器中手动选取一样,精准定位和提取网页上的任意结构化内容,而不仅仅是简单的全文抓取或固定模板提取。

注意事项

不适合抓取需要复杂交互(如登录、滑动验证)或大量 JavaScript 动态渲染内容的网页。

常见问题

这个工具能抓取需要登录才能查看的网页内容吗?

通常不能,它主要处理公开可访问的静态或简单动态网页内容。

提取的数据可以保存为什么格式?

支持输出为 JSON、Markdown、纯文本等多种结构化格式,方便后续处理。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/web-content-pick-mcp/raw/index.md 读取 Web Content Pick MCP 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。