PDF和图片文字提取
从图片和PDF中提取文字,支持OCR识别与格式保留
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:PDF和图片文字提取。 它的用途是:从图片和PDF中提取文字,支持OCR识别与格式保留 详细介绍见:https://321skill.com/skills/extract-text-from-pdf-image-9/ 请根据该页面的说明完成安装。
使用示例
'请从这张产品手册截图里提取所有文字,保持段落格式。' 它会自动识别图片中的文字并返回结构化的文本,保留标题和列表。
对AI说:'把这个PDF合同转为可编辑的文本,保留原文排版。' 它会先判断PDF是否包含文字层,如果有则直接提取,否则启动OCR,最后输出带换行的文本。
介绍
该技能主要解决从图片和PDF文档中提取文字内容的需求。无论是扫描件、截图,还是包含文字的PDF文件,它都能自动识别并提取文字,同时判断文档是否包含文字层,并尽可能保留原始排版格式,输出结构化的结果。
使用方法很简单:用户只需提供图片或PDF文件,AI会自动进行OCR识别或文字提取。支持多种常见图片格式(如PNG、JPG、TIFF)以及PDF文件,无需手动选择模式。提取后的文字会以结构化形式返回,方便后续编辑或分析。
适合需要频繁处理文档中文字的用户,比如学术研究者需要从论文PDF中提取引用文本,数据分析师需要从报表截图获取数据,内容创作者需要从图片中提取文案,以及高校学生整理课件资料等场景。
使用建议:对于清晰、印刷体、标准排版的文档效果最佳;如果图片模糊、手写体或复杂表格,识别准确率可能下降。建议在提取前确保图片分辨率足够,PDF文件非扫描图片层时可直接提取文字。对于大量文档,可以批量处理,但注意单次处理文件大小限制。
常见问题
支持哪些图片格式?
支持常见格式如PNG、JPG、JPEG、TIFF、BMP等,也支持PDF文件。
能识别手写文字吗?
主要针对印刷体文字,手写体识别准确率较低,不建议用于手写文档。