mcp_web_scrapper
基于Node.js的MCP服务器爬虫工具,从glama.ai提取服务器信息
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:mcp_web_scrapper。 它的用途是:基于Node.js的MCP服务器爬虫工具,从glama.ai提取服务器信息 完整的 Skill 内容见:https://321skill.com/skills/mcp-web-scrapper/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“请使用mcp_web_scrapper工具,帮我抓取glama.ai上所有关于‘代码分析’类别的MCP服务器列表。”,它会执行爬虫脚本,访问目标网站,解析页面,并将提取到的服务器信息整理成结构化的列表或JSON文件返回给你,方便你快速筛选和集成。
介绍
这个Skill是一个基于Node.js的MCP服务器爬虫工具,核心功能是自动化地从glama.ai网站抓取和提取MCP服务器信息。它解决了手动收集和整理MCP服务器信息效率低下、容易出错的问题,帮助开发者快速获取最新的可用服务器资源。
使用方式是通过Node.js环境运行该工具,它会模拟浏览器行为访问glama.ai,解析网页结构,并将提取到的服务器信息(如名称、描述、功能、链接等)以结构化的格式(如JSON)输出,方便后续集成或分析。
它非常适合需要批量获取、监控或分析glama.ai上MCP服务器生态的开发者、研究人员或项目管理者。例如,在构建需要集成多个MCP服务器的AI应用时,可以用它来发现和评估可用的工具。
建议在遵守glama.ai网站robots.txt和服务条款的前提下使用,并注意控制请求频率以避免对目标服务器造成过大压力。由于网页结构可能变化,需要定期维护爬虫规则以确保数据抓取的准确性。
核心特点
与通用网页爬虫相比,它专门针对glama.ai的MCP服务器目录页面进行优化,能精准提取服务器元数据;与手动查询相比,它实现了信息抓取的自动化,大幅提升效率。
注意事项
不适合需要实时、高频率抓取动态数据的场景,且依赖glama.ai网站结构的稳定性。
常见问题
这个工具能抓取哪些信息?
主要抓取glama.ai上列出的MCP服务器名称、描述、功能、相关链接等元数据信息。
需要编程基础才能使用吗?
需要基本的Node.js环境配置和命令行操作知识。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/mcp-web-scrapper/raw/index.md 读取 mcp_web_scrapper 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/mcp-web-scrapper/raw/index.md(查看排版版本)