claude-skill-pdf-to-markdown
将完整PDF文档转换为结构化Markdown,保留所有格式和图片。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:claude-skill-pdf-to-markdown。 它的用途是:将完整PDF文档转换为结构化Markdown,保留所有格式和图片。 完整的 Skill 内容见:https://321skill.com/skills/claude-skill-pdf-to-markdown/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
‘请帮我把`/path/to/report.pdf`这份报告的全部内容加载到上下文中。’ 它会自动调用此Skill,将PDF转换为结构化的Markdown,包括所有文字、表格和图片,然后你就可以直接询问关于这份报告的任何细节、请求总结或进行分析了。
介绍
这个Skill解决了从PDF中完整提取文本和结构化信息到AI上下文的难题。传统方法如逐页复制或简单搜索(grep)会丢失格式、表格、图片和文档结构,导致AI无法全面理解文档内容。
使用时,用户只需提供PDF文件路径,Skill会调用独立的Python虚拟环境,将整个PDF转换为一个结构清晰的Markdown文件,并自动提取图片到同级目录。它支持两种提取模式:快速模式(PyMuPDF)和高精度表格模式(Docling)。
它非常适合需要将整份PDF(如研究报告、技术文档、合同、论文)内容完整加载到Claude等AI助手上下文的用户,以便进行深度分析、总结、问答或讨论。
与同类PDF提取工具相比,它的核心优势在于为AI交互场景量身定制,不仅提取纯文本,更专注于保留对AI理解至关重要的文档层级结构(标题、列表、表格、代码块)和视觉元素(图片),并通过积极的缓存机制避免重复处理,提升后续使用效率。
核心特点
专为AI上下文加载设计,不仅提取文本,更完整保留标题层级、表格、列表、代码块等对AI理解至关重要的文档结构,并自动提取图片;内置缓存机制,同一文档首次转换后再次调用瞬间完成。
注意事项
不适合仅需搜索或提取PDF中少量特定片段(如几个关键词)的场景,此时使用grep类工具更高效。
常见问题
转换后的图片在哪里?
图片会自动提取并保存在与生成的Markdown文件同级的`images`文件夹中,使用相对路径引用。
同一个PDF文件需要重复转换吗?
不需要,Skill有积极的缓存机制,只要源文件未修改,后续转换几乎是瞬间完成的。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/claude-skill-pdf-to-markdown/raw/index.md 读取 claude-skill-pdf-to-markdown 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/claude-skill-pdf-to-markdown/raw/index.md(查看排版版本)