@k3_2o/pi-read-image

专为Pi设计的OCR图片转文字工具

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:@k3_2o/pi-read-image。
它的用途是:专为Pi设计的OCR图片转文字工具
完整的 Skill 内容见:https://321skill.com/skills/k3-2o-pi-read-image/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘帮我读取这张截图里的文字’,并附上图片。它会调用该Skill,识别图片中的文本,并将清晰的文字结果返回给你,方便你直接复制使用。

介绍

该Skill旨在解决在Pi平台上无法直接读取图片中文字信息的问题。无论是截取的屏幕图像、终端输出的截图,还是包含代码的图片,用户都可以通过此工具快速提取其中的文本内容,从而摆脱手动抄录的繁琐。

使用方式非常简单。用户只需在Pi中安装此Skill,当遇到需要提取文字信息的图片时,通过简单的指令调用该工具,并指定图片路径或提供图片即可。它会在后台调用Tesseract OCR引擎和ImageMagick图像处理库,自动完成文字识别和提取。

它非常适合经常需要处理截图、文档扫描件或代码图片的开发者、技术文档写作者以及任何需要在Pi环境中进行信息整理和录入的用户。对于需要从大量图像中批量提取文本的场景,也能显著提升效率。

建议在使用前确保系统已安装Tesseract和ImageMagick,并配置好相应的语言包以获得更佳识别效果。对于复杂排版、手写体或低分辨率图片,识别准确率可能下降,建议先对图片进行适当的裁剪、增强等预处理。

核心特点

专为Pi平台深度集成设计,开箱即用,无需复杂配置;同时针对开发者常见的终端输出截图和代码图片场景进行了优化,识别准确率更高。

注意事项

不适合识别手写字体、艺术字或布局极其复杂、背景干扰严重的图片。

常见问题

支持哪些语言的OCR识别?

默认支持英文,安装对应语言包后可支持中文等多种语言。

识别代码图片的效果如何?

针对等宽字体和代码排版进行了优化,能较好地保留缩进和格式。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/k3-2o-pi-read-image/raw/index.md 读取 @k3_2o/pi-read-image 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。