Tmp.Vhz4w2zRLQ

通过Google Gemini模型生成与编辑图像、视频和音乐

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Tmp.Vhz4w2zRLQ。
它的用途是:通过Google Gemini模型生成与编辑图像、视频和音乐
完整的 Skill 内容见:https://321skill.com/skills/tmp-vhz4w2zrlq/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘为我的新产品“智能水杯”生成一组风格一致的展示图片,背景是干净的办公桌。’,它会调用Gemini的Nano Banana模型,生成多张符合描述且视觉风格统一的图像。

对AI说:‘把这张城市风景图变成傍晚时分的氛围,并生成一段10秒的舒缓背景音乐。’,它会先编辑图像,再调用Lyria模型生成匹配的音乐片段。

介绍

这个Skill通过MCP协议调用Google Gemini系列模型,为需要多媒体内容创作的用户提供了强大的AI生成与编辑能力。它主要解决了在创意工作中快速生成高质量图像、视频和音乐素材的难题,无需依赖多个独立工具或复杂的软件操作。

使用时,用户只需通过自然语言向AI助手发出指令,例如“生成一张日落的图片”或“为这个视频片段添加背景音乐”,该Skill便会调用相应的Gemini模型(如Nano Banana用于图像、Omni用于视频、Lyria用于音乐)来完成任务。它支持从文本生成、图像编辑、风格一致性处理到多素材混合等多种操作。

该Skill非常适合内容创作者、营销人员、设计师以及任何需要在项目中快速融入多媒体元素的个人或团队。无论是制作社交媒体帖子、设计演示文稿,还是开发需要视觉或听觉元素的应用程序,都能从中受益。

使用前,请确保已正确安装并配置了所需的MCP服务器包。由于依赖Google Gemini API,生成结果的风格和质量受模型本身能力限制,且可能需要消耗相应的API配额。对于需要极高精度或完全定制化控制的专业级后期制作,建议将其作为创意构思和快速原型制作的辅助工具。

核心特点

该Skill整合了Google Gemini在图像、视频、音乐三个模态的生成与编辑能力于一个统一的MCP接口中,无需在不同AI服务间切换。其“Nano Banana”模型特别擅长生成风格一致的系列图像,这是许多同类图像生成工具所不具备的。

注意事项

不适合需要精细到像素级控制、复杂时间线剪辑或专业音乐编曲与混音的高保真内容制作场景。

常见问题

如何安装和设置这个Skill?

需要先安装 @chrischall/gemini-mcp 包,并按照其文档注册和配置Gemini服务器。

它能生成多长的视频或音乐?

视频和音乐的生成长度受底层Gemini模型(如Omni, Lyria)的能力限制,通常适合生成短视频片段或短音频剪辑。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/tmp-vhz4w2zrlq/raw/index.md 读取 Tmp.Vhz4w2zRLQ 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。