Tmp.Vhz4w2zRLQ

通过Google Gemini模型生成和编辑图像、视频及音乐

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Tmp.Vhz4w2zRLQ。
它的用途是:通过Google Gemini模型生成和编辑图像、视频及音乐
完整的 Skill 内容见:https://321skill.com/skills/tmp-vhz4w2zrlq-x-2/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘用Nano Banana生成一组风格一致的、关于未来都市的赛博朋克风格图片,用于我的项目演示。’,它会调用Gemini图像模型,生成一组视觉风格统一的图片。或者

对AI说:‘为这段描述夏日海滩的文字生成一个15秒的短视频,并配上轻快的背景音乐。’,它会先后或并行调用视频(Omni)和音乐(Lyria)模型来完成你的复合请求。

介绍

这个Skill通过MCP协议调用Google Gemini系列模型(包括Nano Banana和Omni),为用户提供一站式的多媒体内容生成与编辑能力。它解决了在AI工作流中需要切换不同工具来处理图像、视频和音频的痛点,将多种创意任务整合到一个统一的接口中。

使用时,只需向AI助手发出包含特定触发短语的指令,例如“生成一张关于……的图片”或“为这段文本制作一个短视频”,该Skill便会调用相应的Gemini模型来处理请求。它支持从文本生成图像、编辑现有图像、制作风格一致的图像集、混合多张图片,以及从文本或图片生成短视频和音乐片段。

它非常适合内容创作者、营销专员、社媒运营等需要快速产出高质量视觉和音频素材的角色,也适合产品经理、UI设计师用于快速原型构思和演示素材制作。对于全栈或智能体开发者而言,它也是一个强大的集成工具,可以为其应用增添多媒体生成能力。

需要注意的是,使用前必须安装指定的MCP服务器包并完成Gemini API的配置。由于依赖Google的模型,生成内容的质量和速度受API可用性及网络条件影响。对于需要极高分辨率、超长视频或复杂专业音乐制作的场景,可能需要寻求更专业的工具。

核心特点

核心区别在于它通过一个统一的MCP Skill,集成了Google Gemini在图像(Nano Banana)、视频(Omni)和音乐(Lyria)三大领域的生成与编辑能力,而同类Skill通常只专注于其中某一个模态(如图像生成)。

注意事项

不适合需要生成超高清、超长视频或进行复杂专业级音频混音和制作的场景。

常见问题

这个Skill需要什么前置条件?

需要安装 @chrischall/gemini-mcp 包,并配置好可用的Google Gemini API密钥和服务器。

它能生成多长的视频?

通过Gemini Omni模型生成的是短视频,具体时长限制取决于API的当前能力。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/tmp-vhz4w2zrlq-x-2/raw/index.md 读取 Tmp.Vhz4w2zRLQ 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。