qwenspeak

通过SSH调用Qwen3-TTS生成语音,支持克隆和设计声音

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:qwenspeak。
它的用途是:通过SSH调用Qwen3-TTS生成语音,支持克隆和设计声音
完整的 Skill 内容见:https://321skill.com/skills/qwenspeak-x-5/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'帮我用预设的温柔女声生成这段文案的语音:欢迎来到我们的AI技能导航站,这里汇集了最实用的工具。' 它会自动通过SSH连接Qwen3-TTS服务,生成一个MP3音频文件并返回下载链接。如果提供一段某人说话的录音,还可以要求AI克隆该声音后重新生成。

介绍

qwenspeak 是一个基于 Qwen3-TTS 的文本转语音生成工具,通过 SSH 远程调用服务,提供预设声音、声音克隆和声音设计三大核心功能。你只需提供文本或需求描述,它就能快速生成自然流畅的语音音频,支持多种音色选择,甚至可以根据样本克隆特定人物的声音,或从零设计全新的声音特征。

使用方法非常简单:在支持的 AI 编码助手(如 Claude、Trae、Cursor)中,直接说出你的需求,例如“用温柔女声朗读这段文案”或“克隆这段录音的声音并生成新内容”。qwenspeak 会自动通过 SSH 连接 Qwen3-TTS 服务,处理文本并返回音频文件,整个过程无需手动配置服务器。

适合内容创作者、营销专员、视频剪辑师、智能体开发者等需要批量生成语音的场景。无论是制作宣传短片配音、课程讲解音频、社媒视频旁白,还是为 AI 应用添加语音交互能力,qwenspeak 都能显著提升效率。

注意:使用前需确保本地环境能通过 SSH 访问 Qwen3-TTS 服务,并已配置好必要的认证密钥。对于实时性要求极高的场景(如直播互动),建议提前测试网络延迟。声音克隆功能需要提供清晰的原始音频样本,样本质量直接影响克隆效果。

核心特点

与普通 TTS 工具不同,qwenspeak 通过 SSH 远程调用 Qwen3-TTS 服务,无需本地安装大型模型,同时支持声音克隆和声音设计,而不仅仅是预设音色。

注意事项

依赖 SSH 连接和远程 Qwen3-TTS 服务的可用性,网络不稳定或服务端负载高时可能影响生成速度。

常见问题

如何克隆一个声音?

提供一段目标人物的清晰录音(建议10秒以上),AI会分析声纹特征并生成克隆模型,之后即可用该声音合成任意文本。

支持哪些语言?

Qwen3-TTS 支持中文、英文及多种主流语言,具体取决于模型配置。建议使用中文或英文文本以获得最佳效果。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/qwenspeak-x-5/raw/index.md 读取 qwenspeak 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。