Dlazy Jimeng Omnihuman 1.5

用即梦模型生成数字人播报视频

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Dlazy Jimeng Omnihuman 1.5。
它的用途是:用即梦模型生成数字人播报视频
完整的 Skill 内容见:https://321skill.com/skills/dlazy-jimeng-omnihuman-1-5-x/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'用这张人像照片和这段音频生成一段数字人播报视频,主题是产品介绍。' 它会调用即梦OmniHuman 1.5模型,自动合成视频,输出MP4文件。

介绍

本技能解决用户快速生成数字人播报视频的需求,无需专业拍摄设备、绿幕或复杂后期。只需提供一张人像照片和对应的音频或文本,即可自动合成逼真的数字人播报视频,大幅降低视频制作门槛和成本。

使用方法:上传清晰的正面人像照片(支持JPG/PNG),输入需要播报的音频文件(MP3/WAV)或文本内容,选择视频分辨率、时长等参数后调用即梦OmniHuman 1.5模型,系统将自动完成唇形同步、表情驱动、背景渲染等流程,最终输出MP4格式视频。

适合内容创作者、视频剪辑师、营销专员、社媒运营等需要频繁制作人物出镜讲解、产品介绍、课程预告、品牌宣传等场景的用户。也适合希望以数字人形象进行直播或短视频批量化生产的团队。

使用建议:照片建议使用正面免冠、光照均匀的高清人像,音频文件需清晰无噪音,文本内容保持口语化;注意遵守即梦API的使用条款,避免生成涉及敏感或侵权内容。生成时长受API配额限制,大批量任务建议分批次提交。

核心特点

与同类数字人生成工具相比,本Skill基于即梦OmniHuman 1.5模型,支持从单张人像照片和音频/文本直接生成逼真的数字人播报视频,无需训练、无需高配置硬件,生成速度快且效果自然。

注意事项

不适合需要高精度唇形同步或复杂场景互动的视频生成,且依赖即梦API的可用性和配额。

常见问题

需要什么硬件配置?

无需本地GPU,只需联网访问即梦API即可,普通电脑即可运行。

支持哪些语言?

支持中文和英文,音频输入需清晰无杂音,文本输入建议使用短句。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/dlazy-jimeng-omnihuman-1-5-x/raw/index.md 读取 Dlazy Jimeng Omnihuman 1.5 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。