Dlazy Sync Lipsync 3

视频唇形同步工具,输入视频和音频自动匹配口型

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Dlazy Sync Lipsync 3。
它的用途是:视频唇形同步工具,输入视频和音频自动匹配口型
完整的 Skill 内容见:https://321skill.com/skills/dlazy-sync-lipsync-3-x-6/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'请帮我将这段中文演讲视频的唇形同步到英文配音',它会自动调用fal.ai的sync-lipsync v3接口,上传视频和音频,生成唇形匹配的新视频,并返回下载链接。整个过程只需几分钟,无需手动调整关键帧。

介绍

视频配音或本地化时,最头疼的问题就是口型对不上。这个Skill能自动将输入视频中说话人的唇部动作与提供的音频对齐,生成口型完全匹配的新视频,省去逐帧手动调整的繁琐工作。

使用非常简单:只需准备一段视频文件(含说话人正面)和对应的音频文件(或音频URL),通过一句指令即可调用fal.ai的sync-lipsync v3接口。系统会分析视频中的面部特征与音频的时间轴,自动生成口型同步的新视频,并返回下载链接。

适合内容创作者、视频剪辑师、营销专员、翻译团队等需要快速产出多语言视频或配音内容的用户。例如,将英文访谈翻译成中文并同步口型,或为课程视频替换更清晰的旁白,都能大幅提升效率。

建议先用10秒以内的短视频测试效果,确保原始视频中说话人面部清晰、光线充足,音频无明显背景噪音。若视频时长超过5分钟,建议分段处理以避免API超时,同时注意控制Token消耗。

核心特点

基于fal.ai最新的sync-lipsync v3模型,提供高精度唇形匹配,支持多语言配音,相比传统逐帧调整效率提升数十倍。

注意事项

不适合需要高精度面部表情同步(如情感表演)或长视频(超过10分钟)的场景,且对输入视频中说话人的清晰度和正面角度有一定要求。

常见问题

支持哪些视频格式和音频格式?

通常支持MP4、MOV、AVI等常见视频格式,音频支持MP3、WAV、AAC等,具体以fal.ai接口文档为准。

视频和音频时长不一致怎么办?

建议将音频时长裁剪到与视频一致,或使用视频编辑软件先对齐时长,否则会产生口型超前或滞后现象。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/dlazy-sync-lipsync-3-x-6/raw/index.md 读取 Dlazy Sync Lipsync 3 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。