PDF和图片文字提取
从图片和PDF中提取文字,支持OCR识别
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:PDF和图片文字提取。 它的用途是:从图片和PDF中提取文字,支持OCR识别 完整的 Skill 内容见:https://321skill.com/skills/extract-text-from-pdf-image-17/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请提取这张图片中的文字',它会自动识别图片中的印刷体文字并输出为Markdown格式。或者
对AI说:'把这份PDF合同中的所有文字提取出来,保留段落格式',它会解析PDF并输出结构化的文本内容,方便后续编辑或存档。
介绍
该技能专门解决从图片或PDF文档中手动复制文字效率低、易出错的问题。用户只需提供图片或PDF文件,技能即可自动识别并提取其中的文字内容,无需手动输入或逐字校对。
使用方式简单:直接上传图片或PDF文件,技能会先判断文档是否包含文字层(如可编辑PDF),若有则直接提取并保留原始排版;若无则自动调用OCR引擎进行识别,最终输出结构化结果(如Markdown、纯文本或JSON格式)。
适合经常处理扫描件、合同、学术论文、产品说明书等文档的群体,包括学术研究者、文档工程师、内容创作者、高校学生、办公人员等。也适用于需要将纸质资料数字化存储或进一步编辑的场景。
建议使用时确保图片清晰度足够(分辨率≥300dpi),避免倾斜或遮挡。对于复杂排版(如多栏、表格)或手写体,识别效果可能下降,建议后续人工校对。该技能不适用于需要识别图表数据或复杂公式的场景。
常见问题
支持哪些图片格式?
支持常见的图片格式如PNG、JPG、JPEG、BMP、TIFF等,以及PDF文件。
能识别手写文字吗?
主要用于印刷体识别,手写体识别准确率较低,建议谨慎使用。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/extract-text-from-pdf-image-17/raw/index.md 读取 PDF和图片文字提取 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/extract-text-from-pdf-image-17/raw/index.md(查看排版版本)