qwenspeak

通过SSH调用Qwen3-TTS生成语音

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:qwenspeak。
它的用途是:通过SSH调用Qwen3-TTS生成语音
完整的 Skill 内容见:https://321skill.com/skills/qwenspeak-x-2/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“请使用语音克隆,把我提供的这段5秒音频样本作为参考,将以下文案用同样的声线朗读出来,语速稍慢,语气正式。” 它会通过SSH连接到Qwen3-TTS服务,先提取声音特征,再生成克隆语音,最后返回一个音频文件供你下载或播放。

介绍

解决什么问题

文本转语音(TTS)是内容创作、语音交互、辅助工具中的常见需求,但本地部署高质量TTS模型往往需要昂贵的GPU资源,且配置复杂。qwenspeak 技能让你无需在本地运行任何模型,只需通过SSH远程连接,即可调用通义千问最新一代的Qwen3-TTS引擎,快速生成自然流畅的语音。它同时支持预设语音、语音克隆和语音设计三种模式,覆盖从快速配音到个性化定制的完整需求。

怎么用

安装后,你只需在对话中描述你的语音需求。例如:将一段文案转换为指定语速、音色的音频;提供一段人声样本,让AI克隆该声音并说出新文本;或通过文本描述(如“温柔的女声,带一点沙哑质感”)设计全新的语音音色。所有操作通过SSH远程执行,生成的文件会直接返回给你,无需手动管理服务器。

适合谁

内容创作者需要快速为视频、播客、有声书配音;视频剪辑师希望为短片添加旁白而不需额外录音;营销专员需要批量生成广告口语素材或语音样品;智能体开发者希望为AI助手赋予自然语音回复能力。此外,任何需要高质量语音合成但又不想自己搭建模型的人,都能从中受益。

使用建议或注意事项

使用时请确保本地网络能够访问目标SSH服务器,且该服务器已部署Qwen3-TTS服务。注意控制语音样本的授权范围——克隆他人声音需获得明确许可。生成语音的语速、情绪、停顿等细节可通过提示词微调,但复杂的背景音效或混音仍需后期处理。避免用于实时对话场景(如客服实时通话),因SSH调用存在网络延迟。

核心特点

无需本地GPU即可使用Qwen3-TTS,支持语音克隆和语音设计两种高级模式,而多数同类TTS工具仅提供预设语音或需要本地部署模型。

注意事项

不适合要求毫秒级实时响应的场景(如在线语音助手实时对话),因SSH调用存在网络延迟。

常见问题

支持哪些语音?

内置多种预设语音(如温柔女声、沉稳男声、童声等),可通过语音克隆自定义任意声音,也可通过语音设计按文本描述生成新音色。

需要自己准备服务器吗?

需要一台已部署Qwen3-TTS服务的SSH服务器,可以是云服务器或本地机器。安装后配置SSH连接信息即可使用。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/qwenspeak-x-2/raw/index.md 读取 qwenspeak 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。