silicon-paddleocr

基于SiliconFlow API的Claude Code OCR插件,可从图片中提取文字。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:silicon-paddleocr。
它的用途是:基于SiliconFlow API的Claude Code OCR插件,可从图片中提取文字。
完整的 Skill 内容见:https://321skill.com/skills/silicon-paddleocr/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

`/ocr /Users/me/Desktop/screenshot.png`,它会调用 PaddleOCR 模型识别这张截图中的所有文字,并将识别结果以清晰的文本格式返回给你。你也可以说:`/ocr -p "提取表格内容" --json ./data/*.jpg`,它会批量处理指定文件夹下的所有 JPG 图片,并按照你的提示提取表格内容,最终以结构化的 JSON 格式输出结果。

介绍

silicon-PaddleOCR 是一个为 Claude Code 设计的插件,它解决了开发者和内容工作者需要从图片中快速、准确地提取文本信息的问题。通过调用 SiliconFlow 的 API 并集成 PaddleOCR 模型,它能够将 JPG、PNG、WebP、BMP、GIF 等格式图片中的文字内容识别并输出为可编辑的文本。

使用方式非常灵活。在 Claude Code 中安装后,可以直接使用 /ocr 命令后接图片路径来识别单张图片。此外,它也支持通过命令行脚本直接运行,可以进行批量处理(使用通配符匹配多张图片)、自定义识别提示词、以 JSON 格式输出结果以便程序化调用,以及将结果保存到指定文件。

这个插件非常适合需要处理大量图片文档的开发者、数据分析师、内容创作者和研究人员。例如,开发者可以快速提取截图中的代码片段或错误信息;数据分析师可以识别图表中的数据标签;内容创作者可以转换扫描版文档或海报文字。

与同类 OCR 工具相比,它的核心优势在于与 Claude Code 环境的深度集成,提供了便捷的交互式命令。同时,它基于 SiliconFlow 的 API,用户无需本地部署复杂的 OCR 模型环境,降低了使用门槛,并能利用云端模型的强大性能和持续更新。

核心特点

核心区别在于其作为 Claude Code 原生插件的深度集成体验,以及通过 SiliconFlow API 调用云端 PaddleOCR 模型,避免了复杂的本地环境配置和模型管理。

注意事项

不适合需要离线、完全本地化处理或对识别延迟有极端敏感要求的场景。

常见问题

如何获取 SiliconFlow API Key?

访问 SiliconFlow 官网 (siliconflow.cn) 注册并获取 API Key。

支持识别哪些语言的文字?

基于 PaddleOCR 模型,支持中英文等多种语言识别,具体能力取决于所选模型。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/silicon-paddleocr/raw/index.md 读取 silicon-paddleocr 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。