Tmp.Vhz4w2zRLQ
通过MCP用Gemini生成图像、视频、音乐
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Tmp.Vhz4w2zRLQ。 它的用途是:通过MCP用Gemini生成图像、视频、音乐 完整的 Skill 内容见:https://321skill.com/skills/tmp-vhz4w2zrlq-x-6/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'生成一张在森林里举行小型音乐会的插画,风格为水彩画,并基于这张图生成一段10秒的短视频,带背景音乐。' 它会先调用Gemini图像模型生成水彩风格插画,然后调用Omni模型将图像转为短视频,同时用Lyria模型生成一段适合的钢琴背景音乐,最终输出完整的视频文件。
介绍
本Skill利用Google Gemini模型的强大能力,通过MCP(Model Context Protocol)协议,让你在AI对话中直接生成、编辑图像、视频和音乐。它集成了Gemini的Nano Banana图像模型、Omni视频模型和Lyria音频模型,支持从文本创建图像、多图合成、文本/图像生成短视频、以及生成音乐/音频片段。无需切换多个工具,一次对话即可完成多媒体创作。
使用时,只需在AI对话中发出自然语言指令,例如“生成一张日落海滩的图片”、“用Gemini编辑这张照片,把背景换成星空”、“制作一段10秒的短视频,展示城市夜景”或“生成一段30秒的钢琴背景音乐”。AI会调用对应的Gemini模型,直接返回生成结果。支持多轮迭代修改,比如“调亮一些”、“左侧加一只海鸥”等。
适合内容创作者、营销专员、视频剪辑师、社媒运营等需要快速产出视觉和音频素材的人群。无论是制作宣传短片、社媒配图、创意视频,还是生成背景音乐、音效,都能大幅提升效率。尤其适合需要快速迭代创意、生成多版本素材的场景。
使用前需确保已安装@chrischall/gemini-mcp包并注册Gemini服务器(需配置API密钥)。注意:生成质量依赖Gemini模型能力,复杂长视频或高保真音频可能受限;建议用于创意原型、快速预览,而非专业级输出。同时注意API调用成本,避免过度使用。
核心特点
与单独的Gemini API工具不同,本Skill通过MCP协议统一封装了图像、视频、音乐三大生成能力,支持多模态混合创作(如先生成图像再转为视频),且所有操作在对话中自然完成,无需手动切换模型或接口。
注意事项
依赖Gemini API在线服务,不适合离线或私有化部署场景;生成内容受模型能力限制,长视频、复杂场景或高保真音频可能效果不佳。
常见问题
如何安装这个Skill?
执行 npm install @chrischall/gemini-mcp 安装包,然后按照文档配置Gemini服务器(需要API密钥)。
可以生成多长时间的短视频?
目前Gemini Omni模型支持生成数秒的短视频,具体时长取决于模型版本,建议先尝试5-10秒。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/tmp-vhz4w2zrlq-x-6/raw/index.md 读取 Tmp.Vhz4w2zRLQ 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/tmp-vhz4w2zrlq-x-6/raw/index.md(查看排版版本)