qwenspeak
通过SSH调用Qwen3-TTS进行语音合成与克隆
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:qwenspeak。 它的用途是:通过SSH调用Qwen3-TTS进行语音合成与克隆 完整的 Skill 内容见:https://321skill.com/skills/qwenspeak-x/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请帮我用预设的温柔女声朗读这段文本:“你好,欢迎使用语音合成工具。”',它会通过SSH连接Qwen3-TTS服务,生成语音文件并返回。也可以说:'克隆这个音频文件里的声音,然后用它念出订单通知内容',它会先分析声音特征,再合成目标语音。
介绍
qwenspeak 是一个基于 Qwen3-TTS 的语音合成工具,通过 SSH 协议远程调用 TTS 服务,支持预设声音、声音克隆和声音设计。它解决了在无本地 GPU 或需要统一管理 TTS 服务时,快速生成高质量语音音频的需求。用户只需提供文本或少量音频样本,即可获得自然流畅的语音输出。
使用方式非常简单:安装后配置 SSH 连接信息,通过命令行或 API 调用即可。支持多种预设声音,也可以上传目标人的短音频进行声音克隆,甚至可以通过参数调整音色、语速、情感等实现声音设计。所有处理均在远程服务器完成,本地无需下载模型。
适合内容创作者、视频剪辑师、营销专员等需要批量生成语音或个性化配音的用户。例如,为短视频配音、制作有声书、生成广告旁白、克隆特定声音等场景。也适合开发者集成到自动化工作流中。
注意事项:使用前需确保 SSH 目标服务器已部署 Qwen3-TTS 服务且网络连通。声音克隆效果受原始音频质量影响,建议提供清晰、无背景噪音的样本。本工具不提供实时流式合成,适合离线或非实时场景。
核心特点
与其他TTS工具相比,qwenspeak 通过SSH远程调用,无需本地安装大模型,且集成了声音克隆和声音设计能力,适合团队集中管理语音合成服务。
注意事项
不适合对实时性要求高的流式语音合成场景,且依赖远程SSH服务的可用性与网络延迟。
常见问题
支持哪些语言?
支持 Qwen3-TTS 支持的所有语言,主要包括中文、英文,具体见 Qwen3 文档。
需要GPU吗?
不需要,模型运行在服务器端,本地仅需安装客户端和SSH连接。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/qwenspeak-x/raw/index.md 读取 qwenspeak 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/qwenspeak-x/raw/index.md(查看排版版本)