图片-文字识别

从图片中提取文字并描述内容

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:图片-文字识别。
它的用途是:从图片中提取文字并描述内容
详细介绍见:https://321skill.com/skills/图片-文字识别/
请根据该页面的说明完成安装。

使用示例

'请识别这张图片中的文字,并整理成段落输出',然后上传一张包含多行文字的截图,AI会返回提取出的纯文本。如果你想了解图片内容,可以说:'描述这张图片里有什么',AI会分析构图、主体、颜色等,并给出自然语言描述。

介绍

解决什么问题

日常工作中,我们经常遇到需要从图片中获取文字信息的场景——截图里的代码、海报上的联系方式、文档扫描件中的段落。手动逐字抄写不仅效率低下,还容易出错。这个工具利用OCR(光学字符识别)技术,能快速准确地提取图片中的文字,同时还能分析图片内容,为你生成详细的描述,让你不再为“看图识字”而烦恼。

怎么用

使用非常简单:安装后,你只需提供图片的链接或直接上传本地图片文件,然后在对话中告诉AI你的需求——是“提取文字”还是“描述图片内容”。几秒钟内,AI就会返回清晰的文本结果或内容描述。整个过程无需任何手动调整,即开即用。

适合谁

  • 内容创作者:需要从截图、海报中快速获取文字素材,用于二次创作或翻译。
  • 学术研究者:处理文献扫描件、实验数据截图,将图片中的文本转化为可编辑的电子文档。
  • 高校学生:复习时从课件截图、笔记照片中提取文字,方便整理和搜索。
  • 翻译人员:快速从图片中提取外语文本,减少输入时间。

使用建议或注意事项

  • 建议使用清晰、高对比度的图片,以提高识别准确率;手写体、倾斜文字或复杂背景可能影响效果。
  • 图片分辨率不宜过低,建议至少300dpi以上。
  • 若图片中文字较多,可分区域处理,避免一次性上传过大图片。
  • 该工具仅用于文字提取和内容描述,不涉及图片中的人物、物体识别等高级视觉分析。

核心特点

与同类OCR工具相比,本技能同时支持图片链接和本地文件上传,并提供“提取文字”和“描述图片内容”两种独立功能,满足不同场景需求,无需额外切换工具。

注意事项

对复杂排版(如表格、多栏文字)、手写体、艺术字体或低质量图片的识别准确率可能下降。

常见问题

支持哪些图片格式?

支持常见的图片格式,如JPG、PNG、BMP、WEBP等,建议使用JPG或PNG格式。大小建议不超过10MB。

能识别多国语言吗?

可以识别多种主流语言,包括中文、英文、日文、韩文、法文、德文等。具体支持的语言列表取决于底层OCR模型。