Generative-Media-Skills

AI智能体的终极多模态媒体生成与编辑工具集。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Generative-Media-Skills。
它的用途是:AI智能体的终极多模态媒体生成与编辑工具集。
完整的 Skill 内容见:https://321skill.com/skills/generative-media-skills/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“为我的健康饮食App‘蔬轻食’设计一个简洁现代的Logo,主色调为绿色,体现新鲜和科技感。” AI会调用Logo Creator技能,基于几何图形和品牌逻辑生成多个矢量风格的Logo方案供你选择。或者,你可以说:“生成一个30秒的短视频,展示一个人在清晨的城市公园中慢跑,充满活力与希望。” AI将运用Cinema Director技能,从镜头语言、运镜到光线都遵循电影摄影规范来生成视频。

介绍

Generative Media Skills 旨在解决AI智能体(如Claude、Cursor中的AI助手)在多模态内容创作中面临的复杂性和碎片化问题。它提供了一个统一的、高性能的架构,让AI能够直接调用专业级的图像、视频、音频生成与编辑能力,无需开发者手动集成多个API或处理繁琐的底层调用。

用户通过安装其核心命令行工具 muapi-cli,即可在支持的AI Agent环境中(如Claude Desktop、Cursor)直接使用一系列预设的“技能”。这些技能覆盖了从基础文件上传、编辑到专业的电影导演、UI设计、Logo创作等高级场景。AI可以像调用函数一样使用这些技能,并可通过 --view 参数直接预览生成结果。

该工具集非常适合需要在AI工作流中集成视觉或音频内容生成的开发者、内容创作者和AI应用构建者。无论是为营销文案配图、为产品原型设计界面,还是创作短视频素材,都能通过AI指令快速完成。

与同类单点API工具或需要复杂集成的方案相比,它的核心区别在于其“Agent-Native”设计。它不是简单的API封装,而是深度为AI智能体交互优化,提供结构化JSON输出、语义化退出码,并内置了专家知识层(如电影摄影原理、原子设计系统),让AI能产出更专业、更符合领域规范的内容。

核心特点

核心区别在于其“智能体原生”架构和内置的专家知识层。它不仅封装了100+个AI模型API,更通过“专家库”将专业领域知识(如电影导演、UI设计规范)编码成技能,使AI能直接产出符合行业标准的作品,而非仅仅执行基础的生成指令。

注意事项

不适合对生成内容有极精细、像素级手动控制需求,或完全离线、无需任何云API服务的场景。

常见问题

这个技能包支持哪些AI模型?

支持超过100个主流AI模型,包括Midjourney v7, Flux Kontext, Seedance 2.0, Kling 3.0, Veo3等,用于图像、视频和音频生成。

如何在Claude Desktop中使用它?

安装muapi-cli后,运行 `muapi mcp serve` 启动MCP服务器,然后在Claude Desktop设置中添加该服务器地址,即可在对话中直接调用所有媒体技能。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/generative-media-skills/raw/index.md 读取 Generative-Media-Skills 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。