PDF和图片文字提取
从图片和PDF中提取文字,保留格式输出
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:PDF和图片文字提取。 它的用途是:从图片和PDF中提取文字,保留格式输出 完整的 Skill 内容见:https://321skill.com/skills/pdf和图片文字提取-x-6/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请帮我提取这张会议签到表照片中的文字,按姓名和部门列出来。' 它会自动识别图片,输出姓名和部门的列表,格式与原表格一致。
对AI说:'把这份PDF合同中的条款文字提取出来,保留段落编号。' 它会直接读取PDF文字层,输出带编号的条款文本。
介绍
解决什么问题:您是否经常遇到需要从图片截图、扫描件或PDF文档中复制文字,却只能手动逐字敲打的情况?这个Skill帮您一键完成OCR识别与文字提取,支持JPEG、PNG、BMP等常见图片格式以及PDF文件,自动判断文档是否包含文字层,并最大程度保留原始排版(如段落、列表、表格结构),输出清晰的结构化结果,让您直接获得可编辑的文本内容。
怎么用:只需将图片或PDF文件发送给AI,或提供文件路径,说出“提取这张图片里的文字”或“把PDF中的文字转成文本”,Skill会自动调用OCR模型进行识别。对于已有文字层的PDF,则直接提取不重复OCR,避免错误。支持批量处理多个文件,结果会按原顺序和格式整理,方便您复制粘贴到文档、表格或笔记中。
适合谁:适合需要频繁处理扫描件、截图、PDF文档的各类人群,比如学术研究者从论文截图中提取引文,高校学生整理课件讲义中的文字,文档工程师将纸质手册转为电子版,内容创作者从设计稿中提取文案,以及客服人员快速录入客户提供的图片凭证信息。 使用建议:对于清晰、印刷体的文档识别准确率很高,但手写体、艺术字或低分辨率图片可能影响效果,建议先预处理图片(如调整对比度、去噪)。若PDF本身包含文字层,Skill会优先直接提取,无需OCR,速度更快。注意:此Skill不提供PDF编辑或格式转换功能,仅提取文字。
核心特点
同类OCR工具通常需要手动选择语言或模式,且不保留排版;本Skill自动判断文档是否已有文字层(避免二次OCR),并保留原始段落、列表等格式输出结构化结果,同时支持图片和PDF两种输入。
注意事项
对手写体、潦草字迹、低分辨率或严重倾斜的图片识别准确率会下降,且不支持扫描后模糊的PDF中的表格复杂结构还原。
常见问题
支持哪些图片格式?
支持JPEG、PNG、BMP、GIF、TIFF等常见格式,也支持多页PDF文件。
能识别手写文字吗?
可以识别清晰的手写体,但潦草或连笔字识别率较低,建议对图片进行裁切和增强后再提取。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/pdf和图片文字提取-x-6/raw/index.md 读取 PDF和图片文字提取 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/pdf和图片文字提取-x-6/raw/index.md(查看排版版本)