qwenspeak
通过SSH调用Qwen3-TTS生成语音,支持克隆与声音设计
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:qwenspeak。 它的用途是:通过SSH调用Qwen3-TTS生成语音,支持克隆与声音设计 完整的 Skill 内容见:https://321skill.com/skills/qwenspeak-x-3/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请用沉稳的男声朗读这段产品介绍文案,生成MP3文件',它会通过SSH调用Qwen3-TTS模型,选择预设声音或根据你提供的参考音频进行声音克隆,输出音频文件。你也可以进一步要求调整语速或语调,例如'语速加快到1.5倍,语调更柔和'。
介绍
你是否需要为视频、课件或播客快速生成自然流畅的语音?Qwen3-TTS 语音生成 Skill 让你通过简单的对话即可完成文字转语音,无需安装本地模型或配置复杂环境。它基于 Qwen3-TTS 模型,通过 SSH 远程连接提供服务,支持预设声音、声音克隆以及声音设计三大核心功能。无论你是需要标准女声播报新闻,还是定制一个独特的声音角色,这个 Skill 都能帮你快速实现。
使用方法非常简单:你只需在对话中描述你的需求,例如“请用沉稳的男声朗读这段文案,生成MP3”。Skill 会自动通过 SSH 连接到配置好的 Qwen3-TTS 服务,选择合适的预设声音或根据你提供的参考音频进行声音克隆,最终输出语音文件。你还可以进一步调整语速、语调等参数,甚至设计全新的声音特征。整个过程无需手动编写代码或操作命令行。
这个 Skill 特别适合内容创作者、视频剪辑师和营销专员。你可以用它来制作宣传短片的配音、为演示素材添加旁白、生成冥想引导音频,或是为游戏角色、有声书、课程讲解等场景提供语音支持。只要你需要将文字转化为自然语音,它都能成为你的得力助手。
需要注意的是,使用前请确保你的开发环境已配置好 SSH 访问权限,并且远程服务器上部署了 Qwen3-TTS 服务。声音克隆功能需要提供清晰、无背景噪音的参考音频片段(通常 5-10 秒即可)。由于依赖网络传输,生成过程可能会有少量延迟,建议在稳定的网络环境下使用。
核心特点
直接通过 SSH 远程调用 Qwen3-TTS,无需本地部署大模型,同时支持预设声音、声音克隆和声音设计三种模式,灵活性远超单一预设方案的 TTS 工具。
注意事项
依赖网络连接和远程 SSH 服务器,无法离线使用;声音克隆效果受参考音频质量影响较大。
常见问题
如何克隆一个特定人的声音?
提供一段清晰无杂音的目标人声音频(5-10秒),在对话中说明“请克隆这个声音读以下内容”,Skill 会自动提取音色特征并生成语音。
支持哪些预设声音?
Qwen3-TTS 内置多种预设声音,包括男女声、不同年龄和风格,具体列表可在远程服务器上查看,也可在对话中询问“有哪些预设声音可用”。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/qwenspeak-x-3/raw/index.md 读取 qwenspeak 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/qwenspeak-x-3/raw/index.md(查看排版版本)