pi-image-subagent
为非视觉模型提供图像分析能力的Pi扩展
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:pi-image-subagent。 它的用途是:为非视觉模型提供图像分析能力的Pi扩展 完整的 Skill 内容见:https://321skill.com/skills/pi-image-subagent/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'分析这张销售趋势图,告诉我季度变化',它会自动调用视觉子代理解析图片并返回结构化数据。
对AI说:'这张截图里的错误信息是什么?',它会提取图片中的文字并解释。
对AI说:'帮我看看这个产品宣传图里有哪些关键卖点',它会识别图片中的文字和视觉元素并总结。
介绍
不少主流大语言模型未搭载视觉能力,无法直接解析图片内容,遇到需要识别截图、图表、实物照片等场景时,用户需手动切换至多模态模型,易打断工作流、降低使用效率。 它作为Pi生态的轻量扩展组件,内置成熟的视觉能力子代理调度逻辑,用户在原有Pi使用流程中直接传入待分析图片,扩展会自动调用适配的视觉子代理完成图像内容解析,再将结构化结果回传给当前使用的非视觉模型,全程无需手动切换工具或调整模型配置。 适合日常偏好使用非视觉大模型、但有图像分析需求的开发者、办公人员、内容创作者,尤其是已经在使用Pi相关工具链的用户。 使用时尽量上传清晰度高、主体突出的图片,若需要分析图片特定区域内容,可搭配文字标注说明关注范围,能有效提升结果的精准度。
核心特点
它作为Pi生态原生扩展,通过独立视觉子代理调度实现能力补全,无需替换用户当前正在使用的非视觉模型,完全不打断原有工作流。
注意事项
本扩展仅可在Pi生态环境下运行,无法独立使用,图像分析效果受所调用视觉子代理的能力上限约束。
常见问题
非视觉模型安装这个扩展后就能直接分析图片吗?
需在Pi环境下安装启用,即可让接入Pi的非视觉模型获得图像分析能力。
使用时需要额外申请多模态模型的API密钥吗?
无需额外申请,会复用Pi环境中已配置的视觉子代理相关访问凭证。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/pi-image-subagent/raw/index.md 读取 pi-image-subagent 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/pi-image-subagent/raw/index.md(查看排版版本)