MinerU-Skill
一个零配置、快速将PDF/Office/图片文件解析为Markdown的AI原生工具。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:MinerU-Skill。 它的用途是:一个零配置、快速将PDF/Office/图片文件解析为Markdown的AI原生工具。 完整的 Skill 内容见:https://321skill.com/skills/mineru-skill/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“请使用MinerU解析这个PDF论文链接,提取摘要和结论部分,并总结成要点。” 它会调用MinerU技能,将PDF转换为干净的Markdown,然后AI基于清晰的文本进行分析和总结。或者,开发者可以在自动化脚本中直接运行 `python3 scripts/mineru.py ./docs/ --output ./parsed/ --workers 4` 来批量处理一个文件夹中的所有文档。
介绍
MinerU-Skill 是一个专为AI Agent设计的文档解析工具,它能将PDF、Word、PPT、Excel及图片文件高效、准确地转换为结构清晰的Markdown格式,并保留公式、表格和图像。它解决了AI在处理非结构化文档时难以直接读取和利用内容的核心痛点。
使用方式极其简便,无需安装依赖或配置API密钥,通过一个Python脚本即可直接运行。对于小型文件(≤10MB/≤20页),它使用免费的轻量级Agent API,无需消耗token;当处理大型文件、批量任务或需要导出DOCX/HTML/LaTeX格式时,只需设置一个token,工具会自动切换到功能更强大的Standard API,实现智能路由。
它非常适合需要自动化处理大量文档的研究人员、内容创作者、开发者和AI Agent开发者。无论是从学术论文中提取文本和公式,将业务报告转换为可编辑的Markdown,还是为AI Agent构建文档理解管道,MinerU都能提供高效支持。
与同类文档解析工具相比,MinerU的核心优势在于其“AI原生”和“零配置”设计。它无缝集成到AI工作流中,支持通过--stdout将解析结果直接管道传输给AI,并提供了--to选项将内容直接交付到Obsidian等工具。其双后端架构(免费Agent API + 付费Standard API)在成本、易用性和功能强度之间取得了巧妙平衡。
核心特点
核心区别在于其“零配置启动”和“智能API路由”:无需任何安装和密钥即可免费解析小文件,并能根据文件大小、批量需求和导出格式自动在免费API和功能更强的付费API间切换,兼顾了入门门槛与专业需求。
注意事项
免费模式(Agent API)有单文件10MB或20页的限制,且不支持DOCX/HTML/LaTeX格式导出;处理超大文件或复杂格式需使用付费的Standard API。
常见问题
MinerU需要安装Python包或配置API密钥吗?
对于小文件(≤10MB/20页)的简单解析,完全不需要安装任何包或配置密钥,直接运行脚本即可。
MinerU能处理扫描版PDF或图片中的文字吗?
可以,通过`--ocr`参数即可启用OCR功能,识别扫描文档和图片中的文字。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/mineru-skill/raw/index.md 读取 MinerU-Skill 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/mineru-skill/raw/index.md(查看排版版本)