Dlazy Qwen Tts
阿里云千问TTS语音合成,支持方言与自定义语音
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Dlazy Qwen Tts。 它的用途是:阿里云千问TTS语音合成,支持方言与自定义语音 完整的 Skill 内容见:https://321skill.com/skills/dlazy-qwen-tts-x-5/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
‘请用四川话朗读这段广告文案,语速稍快’,它会调用Qwen3-TTS生成方言语音并返回音频文件。或者
对AI说:‘为这段教学视频配音,使用温柔的女声,语速中等’,即可获得符合描述的语音输出,直接用于视频编辑。
介绍
该技能解决文本转语音的需求,基于阿里云百炼平台的Qwen3-TTS模型,提供高质量、多风格的语音合成能力。用户无需手动调整复杂的音频参数,只需输入文字并通过自然语言描述想要的音色、语速、情绪等特征,即可获得生动自然的语音输出。
使用方式简单:在AI对话中直接调用,输入需要朗读的文本,并指定语音偏好(如“用温柔的女声缓慢朗读”或“用四川话快速读”),技能将自动调用云端模型生成音频文件并返回结果。支持多种系统预设语音(包括方言)和自定义语音描述。
适合内容创作者、营销专员、视频剪辑师等需要为视频、演示、广告等素材配音的用户,也适用于教育场景中的课堂演示配音、播客制作、有声读物生成等场景。
建议在使用时注意文本长度,超长文本可分段处理;自定义语音描述应尽量具体(如“像新闻主播一样的男声”),以获得更精准的合成效果。同时注意API调用可能产生费用,需关注阿里云百炼平台的计费规则。
核心特点
与同类TTS技能相比,核心区别在于支持通过自然语言描述自定义语音(如“像老友记里菲比的声线”),无需手动调整音高、共振峰等参数,且内置多款方言语音(如四川话、粤语等),更贴近本地化内容创作需求。
注意事项
不适合需要实时低延迟语音交互的场景(如语音助手即时对话),因为依赖云端API调用,存在网络延迟。
常见问题
支持哪些方言?
目前支持四川话、粤语、东北话等常见方言,具体可在系统语音列表中查看。
如何自定义语音?
直接用自然语言描述你想要的音色和风格,例如“像一个沉稳的50岁男性,带点沙哑”即可。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/dlazy-qwen-tts-x-5/raw/index.md 读取 Dlazy Qwen Tts 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/dlazy-qwen-tts-x-5/raw/index.md(查看排版版本)