Dlazy Kling Audio Clone

上传参考音频,克隆音色生成定制语音

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Dlazy Kling Audio Clone。
它的用途是:上传参考音频,克隆音色生成定制语音
完整的 Skill 内容见:https://321skill.com/skills/dlazy-kling-audio-clone-x-2/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'请用这段音频(附上参考音频链接)帮我生成一句产品广告语:'高效办公,从今天开始。',语气要自然带点亲切感。',它会分析参考音频的音色和情感,输出与原始声音几乎一致的语音文件,可直接用于视频配音或广告投放。

介绍

你是否曾为视频配音、广告旁白或教学演示寻找合适的语音?这款技能让你无需聘请专业声优,只需上传一段参考音频(如某人说话或唱歌的片段),即可通过可灵(Kling)声音克隆模型,生成高度还原该音色的定制语音。无论是品牌宣传、社媒视频还是创意内容,都能快速获得自然、逼真的语音输出。

使用非常简单:安装后,在对话中提供参考音频链接或直接上传文件,并描述你想要的语音内容。技能会自动提取音色特征,生成与参考音频几乎一致的说话风格和语调。整个过程无需手动调整参数,适合快速迭代创意。

本技能特别适合内容创作者、视频剪辑师和营销专员。例如,为产品宣传片生成统一风格的旁白,为短视频批量制作带有人物特色的语音,或为教育课件制作个性化的讲解声音。即使没有专业录音设备,也能产出高质量的音频素材。

建议在使用时提供清晰、无背景噪音的参考音频(3-10秒为宜),并明确指定生成文本的长度和情感倾向。注意:该技能仅负责语音克隆,不包含语音识别或文本转写功能;若需生成多语言语音,需确保参考音频语种与目标一致。

核心特点

与通用TTS(文本转语音)不同,本技能通过上传参考音频进行音色克隆,无需训练新模型,即可复用任意人的声音特质,生成效果高度还原原始音色和情感。

注意事项

不适合生成与参考音频语种差异较大的语音(如用中文参考生成英文),且对音频质量敏感,背景噪音或过短样本会降低克隆效果。

常见问题

支持哪些音频格式?

支持常见格式如MP3、WAV、OGG,建议采样率16kHz以上,时长3-10秒。

生成的语音可以商用吗?

请自行确保参考音频的版权合规,本工具不提供版权担保。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/dlazy-kling-audio-clone-x-2/raw/index.md 读取 Dlazy Kling Audio Clone 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。