mcp

基于MCP协议的网页内容纯净提取工具

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:mcp。
它的用途是:基于MCP协议的网页内容纯净提取工具
详细介绍见:https://321skill.com/skills/mcp-mcp-web-extractor/
请根据该页面的说明完成安装。

使用示例

“请帮我提取并总结这篇关于MCP协议的技术文章,然后保存到我的Obsidian笔记库。”,它会调用 mcp web-extractor 抓取指定链接的纯净文本,进行智能摘要,并按照你预设的模板生成一篇 Markdown 笔记,自动保存到你的 Obsidian 知识库中。

介绍

mcp web-extractor 主要解决用户在浏览网页时,希望快速、纯净地提取核心文本内容,并方便地保存到本地知识库(如 Obsidian)中的需求。它通过 MCP(Model Context Protocol)协议与 AI 助手(如 Claude Desktop)集成,能够智能识别并剥离网页中的广告、导航栏、侧边栏等无关元素,只保留文章主体内容。

使用时,用户只需将网页链接或内容提供给集成了此工具的 AI 助手,AI 助手便会调用该工具提取纯净内容。提取后的内容可以直接复制,或根据预设模板一键保存到 Obsidian 等笔记软件中,形成结构化的知识卡片,极大简化了信息收集和整理的流程。

该工具特别适合需要大量阅读、收集网络信息并进行知识管理的内容创作者、学术研究者和学生。对于需要从网页中快速提取技术文档、行业报告或论文资料的用户来说,它能有效提升信息处理的效率和质量。

建议在使用前确保已正确配置 MCP 服务器和 Claude Desktop(或其他支持 MCP 的客户端)。由于依赖 MCP 协议,其功能发挥与客户端的支持程度紧密相关。提取效果可能因网页结构复杂程度而异,对于高度动态或非标准结构的页面,可能需要手动调整。

核心特点

核心区别在于其基于 MCP 协议实现,能与 Claude 等 AI 助手深度集成,在 AI 对话流程中无缝调用,实现“对话即操作”的提取体验;同时,它原生支持与 Obsidian 集成,提取的内容可一键格式化并保存为本地笔记,打通了从网页抓取到知识入库的完整工作流。

注意事项

不适合需要提取网页中复杂交互元素、动态生成内容或保留原始完整布局(包括特定样式、脚本)的场景。

常见问题

如何与 Obsidian 集成?

需要在工具配置中指定 Obsidian 库的路径和笔记模板,提取的内容会自动按模板保存为 Markdown 文件。

支持提取哪些网站的内容?

支持大多数静态和简单动态网页,对于需要登录或具有复杂反爬机制的网站可能提取失败。