Tmp.Vhz4w2zRLQ
通过Google Gemini模型生成和编辑图像、视频与音乐
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Tmp.Vhz4w2zRLQ。 它的用途是:通过Google Gemini模型生成和编辑图像、视频与音乐 完整的 Skill 内容见:https://321skill.com/skills/tmp-vhz4w2zrlq-x-4/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
‘生成一张未来城市赛博朋克风格的宣传海报’,它会调用Gemini图像模型,快速生成符合描述的高质量图片。
对AI说:‘为这张产品截图制作一个10秒的展示视频’,它会利用Omni模型,将静态图片转化为动态的短视频。
介绍
这个Skill通过MCP协议调用Google Gemini系列模型,为用户提供一站式的多媒体内容生成与编辑能力。它主要解决了创意工作者和开发者在需要快速生成视觉、音频素材或进行简单编辑时的需求,无需切换多个专业软件或平台。
使用时,用户只需在支持的AI助手(如Claude、Cursor)中触发相关关键词,例如“生成一张XX的图片”或“为这个图片添加特效”,Skill便会调用Gemini、Nano Banana、Omni或Lyria等模型来处理请求,并返回生成或编辑后的多媒体文件。
它非常适合UI设计师、内容创作者、营销专员等需要频繁制作宣传素材、配图或短视频内容的角色,也适合全栈开发者在开发AI应用时快速集成多媒体生成功能。
需要注意的是,使用前需确保已正确安装并配置了对应的MCP服务器包。生成的视频为短片,音乐/音频为片段,适合快速原型或内容补充,对于专业级、长篇幅的影视或音乐制作可能不够。
核心特点
核心区别在于整合了Google Gemini生态下的多种专用模型(如图像生成的Nano Banana、视频生成的Omni、音乐生成的Lyria),提供从文生图、图生视频到音乐创作的全链路多媒体生成能力,而非仅聚焦于单一模态。
注意事项
不适合需要生成超长视频、复杂编曲或进行专业级精细后期处理的场景。
常见问题
如何安装和配置这个Skill?
需要先通过npm安装@chrischall/gemini-mcp包,并按照文档注册和启动gemini服务器。
可以生成多长的视频或音乐?
生成的是短格式内容,视频为短片,音乐为音频片段,适合快速内容创作和原型演示。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/tmp-vhz4w2zrlq-x-4/raw/index.md 读取 Tmp.Vhz4w2zRLQ 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/tmp-vhz4w2zrlq-x-4/raw/index.md(查看排版版本)