mcp_web_scrapper

基于Node.js的MCP服务器爬虫工具,从glama.ai提取服务器信息

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:mcp_web_scrapper。
它的用途是:基于Node.js的MCP服务器爬虫工具,从glama.ai提取服务器信息
完整的 Skill 内容见:https://321skill.com/skills/mcp-web-scrapper/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“请使用mcp_web_scrapper工具,帮我抓取glama.ai上所有关于‘代码分析’类别的MCP服务器列表。”,它会执行爬虫脚本,访问目标网站,解析页面,并将提取到的服务器信息整理成结构化的列表或JSON文件返回给你,方便你快速筛选和集成。

介绍

这个Skill是一个基于Node.js的MCP服务器爬虫工具,核心功能是自动化地从glama.ai网站抓取和提取MCP服务器信息。它解决了手动收集和整理MCP服务器信息效率低下、容易出错的问题,帮助开发者快速获取最新的可用服务器资源。

使用方式是通过Node.js环境运行该工具,它会模拟浏览器行为访问glama.ai,解析网页结构,并将提取到的服务器信息(如名称、描述、功能、链接等)以结构化的格式(如JSON)输出,方便后续集成或分析。

它非常适合需要批量获取、监控或分析glama.ai上MCP服务器生态的开发者、研究人员或项目管理者。例如,在构建需要集成多个MCP服务器的AI应用时,可以用它来发现和评估可用的工具。

建议在遵守glama.ai网站robots.txt和服务条款的前提下使用,并注意控制请求频率以避免对目标服务器造成过大压力。由于网页结构可能变化,需要定期维护爬虫规则以确保数据抓取的准确性。

核心特点

与通用网页爬虫相比,它专门针对glama.ai的MCP服务器目录页面进行优化,能精准提取服务器元数据;与手动查询相比,它实现了信息抓取的自动化,大幅提升效率。

注意事项

不适合需要实时、高频率抓取动态数据的场景,且依赖glama.ai网站结构的稳定性。

常见问题

这个工具能抓取哪些信息?

主要抓取glama.ai上列出的MCP服务器名称、描述、功能、相关链接等元数据信息。

需要编程基础才能使用吗?

需要基本的Node.js环境配置和命令行操作知识。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/mcp-web-scrapper/raw/index.md 读取 mcp_web_scrapper 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。