nano-banana

基于Google Gemini API的AI图像、图表与视频生成工具集

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:nano-banana。
它的用途是:基于Google Gemini API的AI图像、图表与视频生成工具集
详细介绍见:https://321skill.com/skills/nano-banana-flight505/
请根据该页面的说明完成安装。

使用示例

'请为我的微服务架构文档生成一张技术示意图。',它会调用Diagram Skill,根据你的架构描述生成一张符合`architecture`文档类型质量标准的专业图表。或者,你可以说:'帮我把这张产品截图做成一个5秒的展示动画。',它会使用Video Skill,基于你的静态图片生成一段平滑的平移或缩放视频。

介绍

nano-banana 是一个专为Claude Code设计的AI生成工具集,旨在解决开发者和内容创作者在制作高质量技术图表、创意图像和视频时面临的耗时与技能门槛问题。它通过调用Google Gemini和Veo模型,将自然语言描述快速转化为视觉内容。

使用方式非常直接:用户只需通过简单的命令行指令,描述想要的图像或视频内容,并指定输出格式和风格(如技术图表、视觉抽象图等),工具便会调用相应的AI模型进行生成。它还支持对现有图像进行基于文本的编辑,以及将静态图片转化为动态视频。

该工具特别适合需要频繁制作演示材料、技术文档配图或创意内容,但缺乏专业设计技能或希望提升效率的开发者、技术写作者和内容创作者。其预设的文档类型和风格选项能很好地适配学术论文、技术架构图、演示文稿等不同场景的需求。

使用前需注意,你需要自行注册并配置Google AI Studio的API密钥。由于依赖云端AI模型,生成复杂内容可能需要一定时间,且会产生相应的API调用费用。建议根据不同的质量要求(通过--doc-type参数设置)来平衡生成速度、成本与效果。

核心特点

核心区别在于集成了AI驱动的质量审查机制,能根据13种不同的文档类型设定质量阈值,仅在生成结果不达标时自动重试,有效节省API调用成本;同时,它将美学风格(如技术、视觉抽象、极简)与内容生成指令分离,通过`--style`参数灵活控制,使输出更符合专业出版要求。

注意事项

不适合需要完全离线、零成本或对生成过程有极细粒度控制(如逐像素编辑)的场景。

常见问题

nano-banana需要付费吗?

工具本身免费开源,但调用Google Gemini和Veo API会产生费用,需自行在Google AI Studio管理API用量和成本。

支持哪些图片和视频格式?

图片通常输出为PNG格式,视频支持MP4等常见格式,具体可参考各技能脚本的参数说明。