claude-media-skills

一个集成图像生成与真实感视频制作的AI媒体创作工具集。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:claude-media-skills。
它的用途是:一个集成图像生成与真实感视频制作的AI媒体创作工具集。
完整的 Skill 内容见:https://321skill.com/skills/claude-media-skills/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘生成一个穿着宇航服在咖啡馆喝咖啡的卡通角色图片,作为视频参考。’,它会调用nano-banana技能生成基础角色图。然后你可以说:‘用刚才的角色,制作一段30秒的视频,介绍这款新咖啡豆,语气轻松愉快。’,它会引导你完成上传图片、撰写符合语速的脚本,并最终调用realistic-ugc-video技能生成一段自然的口播视频。

介绍

这个Skill仓库解决了AI媒体创作中两大核心痛点:一是生成高质量且角色一致的图像,二是制作难以分辨的、真实感强的人物口播视频。它通过整合Google的Nano-Banana(Gemini)模型和Kling 2.6视频生成模型,提供了从静态图像到动态视频的完整工作流。

使用方式主要通过Claude Code技能调用。对于图像生成,用户只需用自然语言触发,并通过脚本命令指定提示词、尺寸和参考图等参数。对于视频制作,则遵循一个清晰的三步流程:先用Nano-Banana生成角色基础图像,上传至指定图床,最后使用Kling 2.6模型结合脚本和音频生成参数来产出视频。

它非常适合内容创作者、社交媒体运营者、小型电商团队以及任何需要快速、低成本产出高质量视觉内容,尤其是需要固定角色出镜的口播视频的用户。对于没有专业视频制作团队但希望建立品牌形象一致性的个人或机构尤其有价值。

使用建议包括:为获得最佳视频效果,需严格控制脚本的语速(约15词/5秒),避免使用易混淆的俚语,并将复合词拆分;确保使用正确的图床服务以保证角色一致性。同时,生成2K或4K高分辨率图像需要使用Pro模型。

核心特点

核心区别在于将角色一致的图像生成与真实感长视频制作无缝衔接,并通过具体的“55-60音节方法”和“15词/5秒”等量化技巧,解决了AI视频普遍存在的语速不自然、角色跳变问题,使成品更接近真人UGC视频。

注意事项

不适合需要复杂场景切换、多角色互动或高度定制化专业影视级特效的视频制作场景。

常见问题

如何保证视频里的人物角色一致?

首先生成一个角色基础图并上传至litterbox.catbox.moe图床,然后在Kling 2.6视频生成时使用该图片的URL作为image_url参数。

生成2K或4K高清图像需要什么?

需要在生成命令中添加--pro标志来调用Pro模型。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/claude-media-skills/raw/index.md 读取 claude-media-skills 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。