Tmp.Vhz4w2zRLQ

通过Gemini API生成和编辑图像、视频、音乐

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Tmp.Vhz4w2zRLQ。
它的用途是:通过Gemini API生成和编辑图像、视频、音乐
完整的 Skill 内容见:https://321skill.com/skills/tmp-vhz4w2zrlq-x-3/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘生成一套风格一致的、关于未来都市的科幻概念图’,它会调用Gemini的图像模型,生成一组主题连贯的图片。或者,

对AI说:‘为我的产品宣传片生成一段30秒的科技感背景音乐’,它会通过Lyria模型创作出相应的音频片段。

介绍

这个Skill让你能够直接通过MCP调用Google Gemini系列模型,一站式完成多媒体内容的生成与编辑。它解决了用户需要快速创建或修改视觉、听觉素材,但缺乏专业工具或设计能力的痛点。

使用时,你只需用自然语言向AI助手描述需求,例如“生成一张日落的图片”或“为这张图添加滤镜”,该Skill便会调用Gemini的图像生成模型(如Nano Banana)、视频生成模型(Omni)或音乐生成模型(Lyria)来完成任务。它支持从文本生成图像/视频、图像混合编辑、生成风格一致的图片组以及创作音乐片段等多种操作。

它非常适合内容创作者、营销专员、社媒运营等需要频繁制作宣传素材的岗位,也适合产品经理、UI设计师用于快速生成产品原型或界面概念图。对于普通用户或学生,它也是一个体验AI创意功能的便捷工具。

需要注意的是,使用前必须确保已安装并正确配置了对应的MCP服务器包。此外,生成内容的质量和风格受Gemini模型本身能力限制,对于极高精度或复杂商业级项目可能仍需专业软件辅助。

核心特点

与单一功能的图像生成Skill不同,它集成了Gemini家族中面向图像、视频、音乐的多个专业模型(如Nano Banana, Omni, Lyria),提供从静态图片到动态视频、再到音频配乐的全链路多媒体创作能力。

注意事项

不适合需要极高分辨率、复杂3D建模或专业级视频剪辑与调色的场景。

常见问题

如何使用这个Skill生成视频?

直接对AI说“制作一个关于城市夜景的短视频”或“根据这张图片生成一段视频”,Skill会调用Gemini的Omni模型进行处理。

生成音乐支持什么格式?

通过Lyria模型生成的通常是简短的音频片段(如背景音乐、音效),具体输出格式取决于后端MCP服务器的实现。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/tmp-vhz4w2zrlq-x-3/raw/index.md 读取 Tmp.Vhz4w2zRLQ 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。