Dlazy Jimeng Omnihuman 1.5
一张照片+语音,生成逼真数字人播报视频
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Dlazy Jimeng Omnihuman 1.5。 它的用途是:一张照片+语音,生成逼真数字人播报视频 完整的 Skill 内容见:https://321skill.com/skills/dlazy-jimeng-omnihuman-1-5/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'用这张人像照片和这段音频,生成一个数字人播报视频,风格为新闻播报,背景用蓝色纯色。' 它会自动调用 OmniHuman 模型,生成口型同步的 MP4 视频文件,并返回下载链接。
介绍
传统数字人视频制作需要专业设备、演员和后期,成本高、周期长。本 Skill 通过即梦 OmniHuman 1.5 模型,仅需一张人像照片和音频/文本输入,即可生成口型同步、表情自然的数字人播报视频,大幅降低创作门槛。
使用方式:安装后,提供一张正面人像图片(支持照片或 AI 生成头像)和一段音频文件(或输入文本),可选播报风格、背景等参数,模型会自动对齐唇形、生成流畅视频。支持多种语言和语速调节。
适合人群:内容创作者、短视频营销人员、视频剪辑师、教育工作者、电商主播等需要快速制作人物讲解或播报视频的场景。无需任何视频剪辑或动画制作经验。
使用建议:为获得最佳效果,请使用清晰、正面、无遮挡的人像照片,音频背景噪声尽量低;注意肖像权问题,避免使用未经授权的他人照片;生成视频分辨率受模型限制,如需 4K 输出需后期放大。
核心特点
相比其他数字人生成工具,OmniHuman 1.5 在口型同步精度、表情自然度和视频连贯性上表现更优,且无需用户进行模型微调或额外训练,即开即用。
注意事项
不适合需要高精度动作捕捉、多人交互或复杂场景切换的专业影视制作场景。
常见问题
支持哪些语言?
支持中文、英文、日文、韩文等多种语言,音频输入需清晰。
需要 GPU 吗?
推荐使用 NVIDIA GPU(如 RTX 3060 以上)以获得快速生成,也支持 CPU 但速度较慢。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/dlazy-jimeng-omnihuman-1-5/raw/index.md 读取 Dlazy Jimeng Omnihuman 1.5 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/dlazy-jimeng-omnihuman-1-5/raw/index.md(查看排版版本)