mgrep
基于语义的跨模态本地文件搜索工具,支持代码、图片、PDF等。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:mgrep。 它的用途是:基于语义的跨模态本地文件搜索工具,支持代码、图片、PDF等。 完整的 Skill 内容见:https://321skill.com/skills/mgrep/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“帮我在当前项目中搜索所有关于用户身份验证的代码和文档。”,它会调用 mgrep 执行语义搜索,返回包含相关代码片段、配置文件甚至注释的PDF中的内容,并用自然语言总结位置和上下文。或者说:“我想找一下项目中关于数据库 schema 设计的讨论或图表。”,mgrep 会跨越代码、Markdown文档和可能的设计图文件进行查找。
介绍
mgrep 解决了开发者和内容工作者在大量本地文件中进行模糊、多语言、跨模态(如图片、PDF)搜索的难题。它通过自然语言理解你的查询意图,而不仅仅是关键词匹配,让你可以用类似“我们在哪里设置认证?”这样的句子快速定位代码或文档。
使用上,首先通过 npm 全局安装并登录,然后在你的项目根目录运行 mgrep watch 进行后台索引。之后,你就可以在任何子目录下使用 mgrep "你的自然语言问题" 进行搜索,它还能通过 --web 参数结合网络搜索结果。
它非常适合需要频繁查阅复杂代码库的全栈开发、智能体开发人员,以及需要管理大量多格式文档(如技术文档、学术论文)的文档工程师和学术研究者。对于项目经理,它也能快速梳理项目上下文。
建议在初次使用时,先在一个中等规模的项目上运行 mgrep watch 观察其索引速度和资源占用。注意其默认有文件大小和数量的限制,大型项目可能需要调整配置。与AI编码代理集成时,它会自动后台同步,但也可以手动控制以节省资源。
核心特点
与传统的 grep 或简单文本搜索工具相比,mgrep 的核心区别在于其真正的语义理解和多模态支持:不仅能理解自然语言查询的意图,还能搜索图片和PDF中的内容,并且设计上原生支持与AI编码代理深度集成,能显著减少Agent的token消耗。
注意事项
不适合搜索未经索引的新增文件或对实时性要求极高的场景,且默认对单个文件大小(1MB)和目录文件数(1000个)有限制。
常见问题
mgrep 如何保护我的代码隐私?
mgrep 通过 Mixedbread 平台进行身份验证和数据处理,具体隐私政策需参考其官方文档。对于敏感项目,建议审查其数据处理协议。
mgrep 能搜索图片里的文字吗?
是的,mgrep 支持对图片进行语义搜索,可以理解图片的内容和上下文,而不仅仅是OCR识别文字。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/mgrep/raw/index.md 读取 mgrep 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/mgrep/raw/index.md(查看排版版本)