Dlazy Qwen Audio Clone

上传人声样本克隆声音,用于TTS语音合成

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Dlazy Qwen Audio Clone。
它的用途是:上传人声样本克隆声音,用于TTS语音合成
完整的 Skill 内容见:https://321skill.com/skills/dlazy-qwen-audio-clone-x-7/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'请克隆我的声音,然后为这段宣传文案生成配音,使用克隆的声音ID。' 它会先要求你上传一段人声样本(如通过录音或文件),完成克隆后返回声音ID,再根据文案生成带有你个人音色的语音文件,可直接用于视频或演示。

介绍

该 Skill 基于阿里云百炼 qwen3-tts 模型,提供声音复刻能力。用户只需上传一段干净、无背景噪音的人声样本(建议 10-30 秒),即可生成一个专属的语音克隆模型。克隆后的声音可在后续 TTS 调用中直接使用,实现个性化语音合成。

使用流程简单:安装并配置阿里云百炼 API 密钥后,调用该 Skill 的接口上传人声样本。系统会自动处理音频、提取声纹特征并生成克隆模型,返回一个声音 ID。后续在 TTS 请求中指定该 ID 即可使用克隆声音。整个过程无需手动训练模型,几分钟内即可完成。

适合内容创作者、视频剪辑师、营销专员等需要定制语音的场景。例如为宣传视频、演示素材、课程讲解、有声读物等生成自然、一致的人声,避免使用千篇一律的合成音,提升内容质感与品牌辨识度。

使用前需确保人声样本清晰、无杂音、语速适中,避免背景音乐或多人对话。克隆声音的效果受样本质量影响较大,建议使用专业录音设备或安静环境录制。此外,该 Skill 依赖阿里云百炼的 API 服务,需要开通对应权限并注意调用费用。

核心特点

直接对接阿里云百炼 qwen3-tts 的官方声音复刻接口,无需自行搭建模型或处理音频特征,上传样本后一键获取可用声音 ID,在后续 TTS 调用中无缝集成。

注意事项

仅支持干净人声样本,不适用于嘈杂环境或需要多种情感/风格混合的语音场景。

常见问题

上传的音频样本有什么格式和时长要求?

建议使用 WAV 或 MP3 格式,时长 10-30 秒,采样率不低于 16kHz,单声道更佳。

克隆的声音可以在多个项目中使用吗?

可以,克隆后获得的声音 ID 可重复用于任何支持阿里云百炼 TTS 的调用,无需重新上传样本。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/dlazy-qwen-audio-clone-x-7/raw/index.md 读取 Dlazy Qwen Audio Clone 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。