Tmp.Vhz4w2zRLQ
通过Gemini API生成和编辑图像、视频、音乐
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Tmp.Vhz4w2zRLQ。 它的用途是:通过Gemini API生成和编辑图像、视频、音乐 完整的 Skill 内容见:https://321skill.com/skills/tmp-vhz4w2zrlq-x-3/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
‘生成一套风格一致的、关于未来都市的科幻概念图’,它会调用Gemini的图像模型,生成一组主题连贯的图片。或者,
对AI说:‘为我的产品宣传片生成一段30秒的科技感背景音乐’,它会通过Lyria模型创作出相应的音频片段。
介绍
这个Skill让你能够直接通过MCP调用Google Gemini系列模型,一站式完成多媒体内容的生成与编辑。它解决了用户需要快速创建或修改视觉、听觉素材,但缺乏专业工具或设计能力的痛点。
使用时,你只需用自然语言向AI助手描述需求,例如“生成一张日落的图片”或“为这张图添加滤镜”,该Skill便会调用Gemini的图像生成模型(如Nano Banana)、视频生成模型(Omni)或音乐生成模型(Lyria)来完成任务。它支持从文本生成图像/视频、图像混合编辑、生成风格一致的图片组以及创作音乐片段等多种操作。
它非常适合内容创作者、营销专员、社媒运营等需要频繁制作宣传素材的岗位,也适合产品经理、UI设计师用于快速生成产品原型或界面概念图。对于普通用户或学生,它也是一个体验AI创意功能的便捷工具。
需要注意的是,使用前必须确保已安装并正确配置了对应的MCP服务器包。此外,生成内容的质量和风格受Gemini模型本身能力限制,对于极高精度或复杂商业级项目可能仍需专业软件辅助。
核心特点
与单一功能的图像生成Skill不同,它集成了Gemini家族中面向图像、视频、音乐的多个专业模型(如Nano Banana, Omni, Lyria),提供从静态图片到动态视频、再到音频配乐的全链路多媒体创作能力。
注意事项
不适合需要极高分辨率、复杂3D建模或专业级视频剪辑与调色的场景。
常见问题
如何使用这个Skill生成视频?
直接对AI说“制作一个关于城市夜景的短视频”或“根据这张图片生成一段视频”,Skill会调用Gemini的Omni模型进行处理。
生成音乐支持什么格式?
通过Lyria模型生成的通常是简短的音频片段(如背景音乐、音效),具体输出格式取决于后端MCP服务器的实现。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/tmp-vhz4w2zrlq-x-3/raw/index.md 读取 Tmp.Vhz4w2zRLQ 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/tmp-vhz4w2zrlq-x-3/raw/index.md(查看排版版本)