gemini-image-skill

调用 Gemini 模型进行 AI 图像生成的 Skill。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:gemini-image-skill。
它的用途是:调用 Gemini 模型进行 AI 图像生成的 Skill。
完整的 Skill 内容见:https://321skill.com/skills/gemini-image-skill/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“帮我画一个未来主义风格的咖啡厅,有巨大的落地窗和悬浮的桌椅。” 它会自动调用此 Skill,将你的描述发送给 Gemini 图像生成 API,并返回一张符合要求的图片链接给你。或者你可以说:“参考这张图片的风格,画一只同样水墨风的仙鹤”,并附上图片,它就会进行图生图创作。

介绍

这个 Skill 解决了用户在 AI 对话中直接进行图像创作的需求。当用户想要将文字描述或参考图片转化为新的视觉图像时,无需切换平台或工具,可直接在对话中调用此 Skill 完成文生图或图生图。

使用方式非常直接:用户只需在对话中表达绘画意图(例如“画一个在太空站喝茶的熊猫”),Skill 便会自动读取配置的 API Key,将用户指令构造成符合 Gemini API 要求的 prompt,并调用接口生成图像,最后将图片 URL 返回给用户。对于图生图,用户需要先上传参考图片。

它非常适合内容创作者、产品经理、营销人员或任何需要在工作中快速进行视觉构思和原型设计的非专业设计师。在头脑风暴、制作演示文稿、撰写社交媒体内容或需要视觉辅助说明时,这个 Skill 能提供即时的图像支持。

与一些内置了简单图像生成功能的通用 AI 相比,此 Skill 专注于对接 Gemini 的图像生成模型,提供了更明确的 prompt 构造规范和调用流程,并且支持多图参考融合等进阶功能,对于希望获得更稳定、可控图像生成结果的用户来说更为专业。

核心特点

核心区别在于提供了清晰、结构化的 prompt 构造规范(区分文生图、图生图、多图参考三种模式),并明确对接 Gemini 的特定图像生成 API,而非使用通用或混合的模型接口。

注意事项

不适合需要生成极高分辨率、复杂专业设计或对图像版权有严格商业要求的场景,且依赖用户自行配置和保管 Gemini API Key。

常见问题

如何用这个 Skill 进行图生图?

需要先按文档指引上传参考图片,然后在 prompt 中以‘图片URL 描述文字’的格式输入指令。

支持生成中文描述的画面吗?

支持,但建议参考文档中的中文文字处理技巧,可能需要对描述进行优化以获得更好效果。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/gemini-image-skill/raw/index.md 读取 gemini-image-skill 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。