Exa网页搜索与抓取

基于Exa的网页搜索与正文抓取MCP服务

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Exa网页搜索与抓取。
它的用途是:基于Exa的网页搜索与正文抓取MCP服务
详细介绍见:https://321skill.com/skills/exa网页搜索与抓取/
请根据该页面的说明完成安装。

使用示例

'搜索2025年1月AI独角兽融资新闻,抓取前5篇文章的正文',它会调用web_search_exa搜索相关网页,再自动调用web_fetch_exa逐个抓取正文,最后汇总返回清洗后的文本。

介绍

解决什么问题:实时网页搜索与正文抓取。传统方法需要手动搜索、复制、清洗,该工具通过自然语言搜索Exa索引,自动抓取网页正文并返回结构化文本,供AI直接消费。适用于新闻、公司、人物、网页资料等在线研究场景。

怎么用:配置EXA_API_KEY后,在支持stdio MCP的客户端(如Claude Desktop、Owlfy、Codex)中安装并启动服务,即可使用web_search_exa进行自然语言搜索,或使用web_fetch_exa直接抓取指定URL的正文内容。返回结果已清洗,无需额外处理。

适合谁:学术研究者需要快速获取论文背景资料;数据分析师搜集行业报告或竞品数据;内容创作者撰写文章时查找最新案例;营销专员做竞品情报分析。也适合需要将网页内容接入AI工作流的开发者。

使用建议:确保Exa API Key有效且配额充足。搜索时使用具体关键词可提高精准度。抓取结果适用于总结、引用、分析,但需注意版权和引用规范。对于动态渲染的页面,该工具可能无法获取完整内容。

核心特点

与普通网页抓取工具不同,Exa支持自然语言语义搜索,而非仅关键词匹配;返回结果自动清洗为纯文本正文,省去HTML解析步骤,直接适配大模型输入格式。

注意事项

不适合需要JavaScript渲染的SPA页面或登录后才能访问的内容。

常见问题

如何获取EXA_API_KEY?

在Exa官网注册账号,即可在控制台生成API密钥。

支持哪些网站抓取?

支持Exa索引覆盖的公开网页,包括新闻、博客、百科等,但不支持需要登录或动态加载的页面。