mgrep

基于语义的跨模态本地文件搜索工具,支持代码、图片、PDF等。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:mgrep。
它的用途是:基于语义的跨模态本地文件搜索工具,支持代码、图片、PDF等。
完整的 Skill 内容见:https://321skill.com/skills/mgrep/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“帮我在当前项目中搜索所有关于用户身份验证的代码和文档。”,它会调用 mgrep 执行语义搜索,返回包含相关代码片段、配置文件甚至注释的PDF中的内容,并用自然语言总结位置和上下文。或者说:“我想找一下项目中关于数据库 schema 设计的讨论或图表。”,mgrep 会跨越代码、Markdown文档和可能的设计图文件进行查找。

介绍

mgrep 解决了开发者和内容工作者在大量本地文件中进行模糊、多语言、跨模态(如图片、PDF)搜索的难题。它通过自然语言理解你的查询意图,而不仅仅是关键词匹配,让你可以用类似“我们在哪里设置认证?”这样的句子快速定位代码或文档。

使用上,首先通过 npm 全局安装并登录,然后在你的项目根目录运行 mgrep watch 进行后台索引。之后,你就可以在任何子目录下使用 mgrep "你的自然语言问题" 进行搜索,它还能通过 --web 参数结合网络搜索结果。

它非常适合需要频繁查阅复杂代码库的全栈开发、智能体开发人员,以及需要管理大量多格式文档(如技术文档、学术论文)的文档工程师和学术研究者。对于项目经理,它也能快速梳理项目上下文。

建议在初次使用时,先在一个中等规模的项目上运行 mgrep watch 观察其索引速度和资源占用。注意其默认有文件大小和数量的限制,大型项目可能需要调整配置。与AI编码代理集成时,它会自动后台同步,但也可以手动控制以节省资源。

核心特点

与传统的 grep 或简单文本搜索工具相比,mgrep 的核心区别在于其真正的语义理解和多模态支持:不仅能理解自然语言查询的意图,还能搜索图片和PDF中的内容,并且设计上原生支持与AI编码代理深度集成,能显著减少Agent的token消耗。

注意事项

不适合搜索未经索引的新增文件或对实时性要求极高的场景,且默认对单个文件大小(1MB)和目录文件数(1000个)有限制。

常见问题

mgrep 如何保护我的代码隐私?

mgrep 通过 Mixedbread 平台进行身份验证和数据处理,具体隐私政策需参考其官方文档。对于敏感项目,建议审查其数据处理协议。

mgrep 能搜索图片里的文字吗?

是的,mgrep 支持对图片进行语义搜索,可以理解图片的内容和上下文,而不仅仅是OCR识别文字。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/mgrep/raw/index.md 读取 mgrep 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。