PDF和图片文字提取
从图片/PDF中精准提取文字内容
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:PDF和图片文字提取。 它的用途是:从图片/PDF中精准提取文字内容 完整的 Skill 内容见:https://321skill.com/skills/pdf和图片文字提取-x-14/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'从这张会议纪要截图里提取文字,保留原段落格式',它会自动识别图片中的文字并按原样输出。或者
对AI说:'把这个PDF中的所有文字提取出来,保存为Markdown文件',它会逐页解析并生成结构化的Markdown文档。
介绍
你是否经常需要从扫描件、截图或PDF文档中复制文字,却只能手动逐字敲打?这个技能可以帮你自动识别并提取图片或PDF中的文字内容,支持JPG、PNG、PDF等多种格式,还能自动判断文档是否包含文字层,优先保留原始排版,输出结构化结果。
使用非常简单:直接上传图片或PDF文件,或输入文件路径,技能会自动识别文字区域,并返回可编辑的文本。你还可以指定输出格式(如纯文本、Markdown、JSON),或要求保留段落、表格等结构。对于多页PDF,它会逐页提取并合并结果。
适合需要频繁处理文档的各类用户:内容创作者整理素材、学术研究者提取文献段落、数据分析师抓取报表数据、学生整理课件笔记、客服人员处理客户提供的截图信息等。尤其适合那些需要将非可编辑文档转化为可编辑文本的场景。
建议在以下情况使用:图片清晰、文字对比度较高、非手写体时效果最佳;对于复杂排版(如多栏、表格嵌套)或低分辨率图片,提取结果可能需人工校对。注意本技能仅提取文字,不保留图片中的图形或公式。
核心特点
与通用OCR工具不同,本技能自动判断文档是否已有文字层(如可复制PDF),直接提取文字而非重新识别,避免重复消耗;同时保留原始格式(段落、换行、缩进)输出结构化结果,而非纯文本流。
注意事项
不适合手写体识别、模糊图片、复杂表格或公式场景,也不支持生成可搜索PDF。
常见问题
支持哪些图片格式?
支持JPG、PNG、BMP、TIFF、WebP等常见格式,以及PDF文件。
能识别手写文字吗?
主要针对印刷体文字优化,手写体识别准确率较低,建议使用专用手写OCR工具。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/pdf和图片文字提取-x-14/raw/index.md 读取 PDF和图片文字提取 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/pdf和图片文字提取-x-14/raw/index.md(查看排版版本)