PDF和图片文字提取

从图片或PDF中智能提取文字,支持多种格式并保留原始结构。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:PDF和图片文字提取。
它的用途是:从图片或PDF中智能提取文字,支持多种格式并保留原始结构。
完整的 Skill 内容见:https://321skill.com/skills/pdf和图片文字提取-x-2/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'请帮我提取这张产品说明书截图里的文字内容,并整理成文档。',它会自动识别图片中的文字,并按原格式输出结构清晰的文本。或者

对AI说:'这份扫描版的PDF合同,我需要里面的条款文字。',它会解析PDF,准确提取所有文字信息并保留条款的编号和层级。

介绍

本技能专为解决从非结构化文档(如扫描件、截图、PDF文件)中提取可编辑文本的难题。它能够自动识别图片或PDF中的文字区域,运用OCR技术进行精准识别,并将结果以结构化的方式输出,如保留段落、列表等原始格式,方便用户直接复制或进行后续编辑。

使用时,用户只需将包含文字的图片或PDF文件提供给AI助手,助手便会调用此技能进行处理。整个过程自动化程度高,无需用户手动选择文件类型或调整识别参数,技能会自动判断内容是否包含文字并进行处理。

该技能非常适合需要处理大量纸质文档电子化、整理扫描版资料、或从设计稿、截图等图片中获取文字信息的各类角色。无论是学生整理笔记、研究人员处理文献,还是办公人员处理合同文件,都能从中受益。

建议在处理清晰度较高的文件时使用,以获得最佳识别效果。对于排版复杂、手写体或背景干扰严重的文档,识别准确率可能会受到影响,建议先对原文件进行适当优化(如调整对比度、裁剪无关区域)后再使用。

核心特点

核心优势在于自动判断文件是否包含文字,并能在提取后保留原始文档的段落、列表等格式结构,输出结构化结果,而非简单的纯文本堆砌。

注意事项

对于手写字体、模糊图片或排版极其复杂的文档,识别准确率可能有限。

常见问题

支持哪些图片和PDF格式?

支持常见的图片格式(如JPG、PNG)和PDF文档,技能会自动判断并处理。

提取的文字能保持原来的格式吗?

可以,技能会尽可能保留原始文档的段落、列表等结构,输出结构化文本。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/pdf和图片文字提取-x-2/raw/index.md 读取 PDF和图片文字提取 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。