PDF和图片文字提取

从图片或PDF中精准提取文字,保留原始格式。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:PDF和图片文字提取。
它的用途是:从图片或PDF中精准提取文字,保留原始格式。
完整的 Skill 内容见:https://321skill.com/skills/pdf和图片文字提取-x-12/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘请帮我提取这份产品说明书扫描PDF里的所有文字内容,并整理成带标题的文档。’ 它会自动识别PDF中的文字,进行OCR转换,并按照原文的章节结构输出一份可编辑的文本文件。或者,当你有一张包含会议纪要的白板照片时,对它说‘识别这张照片里的文字’,即可快速获得电子版笔记。

介绍

本技能专注于解决从非结构化文档(如扫描图片、PDF文件)中提取可编辑文本的难题。它能够自动识别图像或PDF中的文字区域,通过OCR技术进行精准识别,并将结果以结构化的形式输出,方便用户进行后续的编辑、分析和存档。

使用时,用户只需提供图片或PDF文件,技能会自动判断文件类型并调用相应的处理引擎。对于图片,支持JPG、PNG等多种格式;对于PDF,无论是扫描件还是原生文档都能有效处理。提取过程会尽量保留原文的段落、列表等格式信息。

该技能非常适合需要处理大量纸质文档电子化、从报告或合同中提取关键信息、或对扫描版文献进行文本分析的用户。无论是学生、研究人员、法务人员还是内容创作者,都能从中受益。

建议在使用前确保图片清晰、光线均匀,PDF文件如果不是加密或受保护的版本,识别效果更佳。对于复杂排版或手写体,识别准确率可能有所下降,建议提取后进行人工校对。

核心特点

核心优势在于能自动判断输入内容是否包含文字,并智能选择处理方式;同时,它致力于保留原文的格式结构(如段落、标题),输出结构化结果,而非简单的纯文本流,便于后续直接使用。

注意事项

不适合处理手写体、艺术字体或布局极其复杂、模糊低质的文档。

常见问题

支持哪些图片和PDF格式?

支持JPG、PNG、BMP等常见图片格式,以及标准PDF文档(包括扫描件)。

提取的文字能保留原来的格式吗?

是的,技能会尽力识别并保留原文的段落、换行等基本格式,输出结构化文本。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/pdf和图片文字提取-x-12/raw/index.md 读取 PDF和图片文字提取 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。