Agent Paddleocr Vision

多语言文档OCR识别与理解

效率工具 文档工程师翻译人员学术研究者 处理文档和PDFs 通用 ★ 922 更新于 2026-08-01

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Agent Paddleocr Vision。
它的用途是:多语言文档OCR识别与理解
完整的 Skill 内容见:https://321skill.com/skills/agent-paddleocr-vision-x-6/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'帮我识别这张多语言合同扫描件中的文字,逐段输出并标注语言',它会调用PaddleOCR检测所有文字块,识别语种并返回结构化的JSON或Markdown结果。

介绍

该技能解决多语言文档的自动识别与理解问题,支持从扫描件、图片、PDF中提取文字并结构化输出,适用于需要快速处理大量文档的场景。 使用方式:用户上传图片或PDF文件,技能自动调用PaddleOCR进行文字检测与识别,支持中文、英文、日文、韩文等多种语言,返回识别结果及置信度,可进一步用于翻译、摘要、数据提取等后续处理。 适合需要频繁处理文档的文档工程师、翻译人员、学术研究者,以及需要从文档中提取数据进行分析的数据分析师和内容创作者。 建议在光线充足、文字清晰的文档上使用;手写体、复杂排版或低分辨率图片的识别准确率可能下降,可配合后处理校正。

核心特点

相比其他OCR技能,PaddleOCR内置多语言模型且轻量高效,无需额外下载语言包,在中文、英文等多语混合文档上表现稳定,且支持端侧部署。

注意事项

不适合高精度手写体识别或极度扭曲、模糊的图片场景。

常见问题

支持哪些语言?

支持中、英、日、韩、法、德、西等80余种语言,可自动检测或指定语言。

需要GPU才能运行吗?

不需要,CPU即可运行,但GPU会大幅提升速度。推荐使用CUDA加速。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/agent-paddleocr-vision-x-6/raw/index.md 读取 Agent Paddleocr Vision 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。