qwen3-tts-skill

一个供AI调用的通义千问Qwen3-TTS语音合成技能

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:qwen3-tts-skill。
它的用途是:一个供AI调用的通义千问Qwen3-TTS语音合成技能
完整的 Skill 内容见:https://321skill.com/skills/qwen3-tts-skill/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘请使用Qwen3-TTS技能,用中文生成一段欢迎语音,文本是“欢迎使用我们的智能助手”,保存到outputs文件夹。’,AI会执行类似`uv run scripts/run_qwen3_tts.py custom-voice --language Chinese --text "欢迎使用我们的智能助手" --out-dir outputs`的命令,为你生成一个WAV文件。或者,你可以让AI‘设计一个听起来成熟稳重的男声来朗读这份产品介绍’,AI则会调用`voice-design`子命令来实现。

介绍

这个技能解决了AI Agent或开发者需要将文本转换为高质量语音的问题。它封装了通义千问Qwen3-TTS模型的能力,允许AI通过命令行直接调用,生成多种风格的语音文件,包括定制语音、语音设计、语音克隆和分词器测试。

使用方式非常直接:AI或用户通过uv run命令执行提供的Python脚本,并指定相应的子命令(如custom-voicevoice-design)和参数(如语言、文本、输出目录),即可在指定目录生成WAV格式的音频文件。整个过程无需复杂的代码集成。

它非常适合智能体开发者、内容创作者、产品原型设计者以及任何需要在自动化流程或AI应用中集成语音合成功能的用户。无论是为智能体赋予“说话”能力,还是批量生成有声内容,这个技能都能提供便捷的接入方式。

使用建议是,首次使用前请确保已安装Python和uv工具。对于Windows用户,注意在命令中传递包含盘符的绝对路径时,需要用双引号包裹。生成音频的质量和速度可以通过--device-map--dtype等性能相关标志进行调整。

核心特点

核心区别在于它是专为AI/Agent调用设计的,提供了标准化的命令行接口,而非传统的SDK或API集成方式;同时,它直接集成了Qwen3-TTS最新的多种语音生成模式(如VoiceDesign、VoiceClone),功能更为集中和前沿。

注意事项

不适合需要实时、低延迟流式语音合成或深度定制模型架构的场景。

常见问题

如何安装和运行这个技能?

需要先安装Python和uv,然后克隆仓库,在项目目录下使用`uv run scripts/run_qwen3_tts.py`加上相应子命令和参数即可运行。

支持哪些语言和声音?

支持中文、英文等多种语言,声音可选择预设的说话人(CustomVoice),或通过自然语言描述设计声音(VoiceDesign),也支持从参考音频克隆声音(VoiceClone)。具体选项请参考SKILL.md文档。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/qwen3-tts-skill/raw/index.md 读取 qwen3-tts-skill 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。