Exa网页搜索与抓取
基于Exa的网页搜索与正文抓取MCP服务
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Exa网页搜索与抓取。 它的用途是:基于Exa的网页搜索与正文抓取MCP服务 详细介绍见:https://321skill.com/skills/exa网页搜索与抓取/ 请根据该页面的说明完成安装。
使用示例
'搜索2025年1月AI独角兽融资新闻,抓取前5篇文章的正文',它会调用web_search_exa搜索相关网页,再自动调用web_fetch_exa逐个抓取正文,最后汇总返回清洗后的文本。
介绍
解决什么问题:实时网页搜索与正文抓取。传统方法需要手动搜索、复制、清洗,该工具通过自然语言搜索Exa索引,自动抓取网页正文并返回结构化文本,供AI直接消费。适用于新闻、公司、人物、网页资料等在线研究场景。
怎么用:配置EXA_API_KEY后,在支持stdio MCP的客户端(如Claude Desktop、Owlfy、Codex)中安装并启动服务,即可使用web_search_exa进行自然语言搜索,或使用web_fetch_exa直接抓取指定URL的正文内容。返回结果已清洗,无需额外处理。
适合谁:学术研究者需要快速获取论文背景资料;数据分析师搜集行业报告或竞品数据;内容创作者撰写文章时查找最新案例;营销专员做竞品情报分析。也适合需要将网页内容接入AI工作流的开发者。
使用建议:确保Exa API Key有效且配额充足。搜索时使用具体关键词可提高精准度。抓取结果适用于总结、引用、分析,但需注意版权和引用规范。对于动态渲染的页面,该工具可能无法获取完整内容。
核心特点
与普通网页抓取工具不同,Exa支持自然语言语义搜索,而非仅关键词匹配;返回结果自动清洗为纯文本正文,省去HTML解析步骤,直接适配大模型输入格式。
注意事项
不适合需要JavaScript渲染的SPA页面或登录后才能访问的内容。
常见问题
如何获取EXA_API_KEY?
在Exa官网注册账号,即可在控制台生成API密钥。
支持哪些网站抓取?
支持Exa索引覆盖的公开网页,包括新闻、博客、百科等,但不支持需要登录或动态加载的页面。