Tmp.Vhz4w2zRLQ
用Gemini模型生成/编辑图像、视频和音乐
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Tmp.Vhz4w2zRLQ。 它的用途是:用Gemini模型生成/编辑图像、视频和音乐 完整的 Skill 内容见:https://321skill.com/skills/tmp-vhz4w2zrlq-x-7/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'生成一张赛博朋克风格的猫的图片',它会调用Gemini模型快速生成图像。'编辑这张图片,把背景换成星空',它会自动识别图片并编辑。'生成一段10秒的短视频,内容为海浪拍打沙滩,并配上轻松的钢琴背景音乐',它会同时调用视频和音乐模型合成输出。
介绍
本Skill通过MCP协议将Google Gemini的多模态生成能力引入你的AI开发环境。你可以直接让AI调用Gemini生成一张图片、一段短视频或一段音乐,也能对已有图片进行编辑、混合多张图片,或从文字/图片生成视频。它整合了Gemini的Nano Banana图像生成、Omni视频生成和Lyria音频生成能力,让你无需离开对话界面就能完成多媒体创作。
使用非常简单:只需在对话中自然描述你的需求,比如“生成一只柴犬的图片”、“把这张照片的背景换成海滩”、“做一段10秒的日落视频”、“写一段30秒的钢琴曲”。AI会识别你的意图并自动调用对应的Gemini模型。所有操作都在MCP框架内完成,无需手动切换工具或编写代码。
适合内容创作者、营销人员和视频剪辑师,尤其是需要快速产出视觉素材或音频素材的场景。比如制作社媒配图、生成宣传短片、为播客添加背景音乐、为课件配图等。也适合开发者在AI应用中集成多媒体生成能力时快速验证想法。
使用前需要安装@chrischall/gemini-mcp包并在MCP配置中注册Gemini服务器。注意Gemini API有调用配额和费用,建议先确认你的API Key有足够的额度。生成视频和音乐时长有限,长内容可能需分段操作。
核心特点
与其他单一图像生成工具不同,该Skill在一个MCP接口内同时支持图像、视频、音乐三种媒体的生成与编辑,且能通过自然语言混合调用(如“把这张图做成视频并配上音乐”)。
注意事项
不适合生成超长视频(如电影)、高保真专业音乐混音,或需要精细局部控制的图像编辑。
常见问题
如何安装这个Skill?
在终端执行 npm install @chrischall/gemini-mcp,然后在MCP配置文件中注册gemini服务器,并设置你的Gemini API Key。
生成视频需要多长时间?
取决于视频长度和当前API负载,通常10秒以内的短视频在几十秒内完成。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/tmp-vhz4w2zrlq-x-7/raw/index.md 读取 Tmp.Vhz4w2zRLQ 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/tmp-vhz4w2zrlq-x-7/raw/index.md(查看排版版本)