Tmp.Vhz4w2zRLQ

用Gemini生成/编辑图像、视频、音乐

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Tmp.Vhz4w2zRLQ。
它的用途是:用Gemini生成/编辑图像、视频、音乐
完整的 Skill 内容见:https://321skill.com/skills/tmp-vhz4w2zrlq-x-5/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'生成一张赛博朋克风格的城市夜景图片,并制作一段10秒的短视频,同时配上一段电子音乐背景',它会先调用Nano Banana生成图像,再用Omni模型将图像转为短视频,最后用Lyria生成匹配的电子音乐片段,整个过程无需切换工具。

介绍

本Skill通过MCP协议集成Google Gemini多模态模型,让您能够直接在对话中完成图像生成与编辑、视频生成、音乐创作等任务。它解决了传统AI工具需要切换多个平台或手动调用API的痛点,将Nano Banana(图像编辑)、Omni(视频生成)、Lyria(音乐生成)等能力统一到一个接口,大幅提升多模态内容创作效率。

使用方式非常简单:在支持MCP的AI客户端(如Claude等)中配置该Skill后,直接以自然语言描述需求即可。例如,说“生成一张夕阳海滩的图片”、“用Gemini把这张图里的人换掉”、“创建一个三张风格一致的插画”、“根据这段文字生成一个10秒短视频”或“创作一首钢琴曲”,Skill会自动调用对应的Gemini模型完成创作,无需手动切换工具或编写代码。

它最适合内容创作者、营销人员、视频剪辑师、社媒运营等需要快速产出视觉和音频素材的用户。你可以在制作社交媒体海报、商品宣传视频、产品演示动画、背景音乐时,用它快速生成初稿,再结合专业工具进行精修。学术研究者、教师也可用于制作教学演示素材。

使用前需确保已安装@chrischall/gemini-mcp包并在MCP配置中注册Gemini服务器(需有效API密钥)。注意,生成内容的质量和速度受Gemini模型能力及API配额限制,部分复杂编辑或长视频可能需要多次尝试。建议用于创意发散和快速原型验证,对精细度要求极高的专业作品建议配合后期处理。

核心特点

与同类MCP工具相比,本Skill不仅支持图像生成和编辑,还涵盖了视频(文本/图像→视频)和音乐生成,覆盖了多模态创作全链路,且通过Nano Banana、Omni、Lyria等专用模型分别优化各领域效果,而非用一个通用模型勉强应付。

注意事项

不适合需要本地离线运行或对生成速度有严格实时的场景,且视频和音乐生成质量受限于Gemini API当前版本,不支持长视频(超过10秒)或复杂编曲。

常见问题

这个Skill需要安装什么?

需要安装npm包@chrischall/gemini-mcp,并在MCP配置文件中注册Gemini服务器(需提供API密钥)。

支持哪些类型的生成?

支持图像生成与编辑(Nano Banana)、视频生成(文本→视频/图像→视频,Omni模型)、音乐/音频生成(Lyria模型)。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/tmp-vhz4w2zrlq-x-5/raw/index.md 读取 Tmp.Vhz4w2zRLQ 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。