Tmp.Vhz4w2zRLQ

用Gemini模型生成/编辑图像、视频和音乐

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Tmp.Vhz4w2zRLQ。
它的用途是:用Gemini模型生成/编辑图像、视频和音乐
完整的 Skill 内容见:https://321skill.com/skills/tmp-vhz4w2zrlq-x-8/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'生成一张未来城市夜景的图片,霓虹灯风格,分辨率1920x1080',它会调用Gemini Nano Banana模型生成对应图像并返回。

对AI说:'把这张猫的照片和那张风景图合成一张,猫在草地上',它会执行图像融合操作。

对AI说:'生成一段10秒的视频,内容是一只狗在沙滩上奔跑,配上轻快的背景音乐',它会调用Omni和Lyria模型分别生成视频和音频并合成输出。

介绍

你是否曾为了一张配图、一段短视频或一段背景音乐而频繁切换工具?这个MCP Skill将Google Gemini系列模型(包括图像生成模型Nano Banana、视频生成模型Omni、音乐生成模型Lyria)的能力整合到你的AI工作流中,让你在对话中直接完成多模态创作,无需离开当前环境。

使用时,只需在对话中自然描述你的需求,例如“生成一张夕阳下的海滩图片”、“把这两张图融合成一张”、“制作一段5秒的猫跳舞视频”或“生成一段30秒的钢琴曲”。Skill会自动识别任务类型,调用对应的Gemini模型完成生成、编辑、合成或混合操作。支持图像生成与编辑、多图合成、文生视频、图生视频、音乐/音频片段生成等场景,所有操作通过MCP协议在本地或远程服务器上执行。

适合内容创作者、营销专员、视频剪辑师以及任何需要快速生成或编辑视觉/听觉素材的创意工作者。无论是制作社媒配图、宣传短片、产品演示视频,还是为项目添加背景音乐,这个Skill都能帮你把灵感转化为成品,大幅缩短从想法到产出的链路。

使用前请确保已安装@chrischall/gemini-mcp包并正确配置Gemini API密钥。由于依赖云端模型,生成速度和质量受网络和API配额影响,建议在稳定网络环境下使用。对于需要精细控制或超长视频/音乐的场景,请结合专业编辑工具进行后期处理。

核心特点

市面上多数MCP工具仅支持单一模态(如图像或文本),而本工具同时覆盖图像、视频、音乐三大创作领域,且直接调用Google Gemini最新模型(Nano Banana、Omni、Lyria),无需额外安装多个插件。

注意事项

不适合需要高精度逐帧编辑或专业级混音的场景,且生成结果依赖Gemini API的可用性和配额限制。

常见问题

如何安装这个MCP工具?

运行 npm install @chrischall/gemini-mcp 安装包,然后根据项目文档配置Gemini API密钥并注册MCP服务器。

支持哪些模型?

图像生成/编辑使用Gemini Nano Banana模型,视频生成使用Omni模型,音乐生成使用Lyria模型。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/tmp-vhz4w2zrlq-x-8/raw/index.md 读取 Tmp.Vhz4w2zRLQ 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。