Dlazy Qwen Tts
阿里通义千问3代TTS语音合成,支持系统音色与自定义描述生成。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Dlazy Qwen Tts。 它的用途是:阿里通义千问3代TTS语音合成,支持系统音色与自定义描述生成。 完整的 Skill 内容见:https://321skill.com/skills/dlazy-qwen-tts-x-2/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
‘用“知性温和的女声”将这篇产品介绍稿转换成语音,时长控制在1分钟左右。’,它会调用Qwen TTS技能,根据你的描述生成对应的语音文件。或者你可以说:‘我需要一段带有四川方言特色的欢迎语音,内容是这个……’,它会从预置的方言音色库中选择匹配的选项进行合成。
介绍
Dlazy Qwen Tts Skill 解决了在AI对话和自动化流程中需要高质量、多样化语音输出的需求。它基于阿里云百炼平台的qwen3-tts模型,能够将文本转换为自然流畅的语音。
使用方式非常灵活,你可以直接选择预置的系统音色,其中包含多种方言选项,满足不同地域和文化背景的需求。更独特的是,你可以通过自然语言描述来设计一个完全自定义的虚拟音色,例如“一个温柔、略带磁性的中年男性声音,语速适中”,系统会尝试根据描述生成对应的语音。
这个Skill非常适合需要为AI助手、播客内容、视频配音、有声读物或交互式应用添加语音功能的内容创作者、产品经理和全栈开发者。它降低了获取专业级语音合成的门槛,无需复杂的音频工程知识。
在使用时,建议先尝试预置音色,找到最接近需求的选项。如果需要高度定制化,在描述自定义音色时,尽量使用具体、可感知的形容词(如“欢快”、“沉稳”、“带有一点口音”),这有助于模型更准确地理解你的意图。注意,生成语音的质量和自然度会受到输入文本长度和复杂性的影响,过长的句子可能需要分段处理以获得最佳效果。
核心特点
核心区别在于支持通过自然语言描述定制专属音色,而不仅仅是选择预设声音;同时提供了包含方言在内的多样化预置系统音色库,在中文语音合成的自然度和情感表达上表现突出。
注意事项
不适合需要极低延迟的实时语音交互场景,且自定义音色的生成效果对描述文本的准确性依赖较高。
常见问题
支持哪些方言或语言?
主要支持中文普通话及多种中文方言(具体需查看模型文档),暂不支持其他语种。
自定义音色描述有什么技巧?
使用具体、感性的词汇描述音色特质,如“清脆的女声,带一点南方口音,语速轻快”。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/dlazy-qwen-tts-x-2/raw/index.md 读取 Dlazy Qwen Tts 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/dlazy-qwen-tts-x-2/raw/index.md(查看排版版本)