qwenspeak
通过SSH调用Qwen3-TTS生成语音
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:qwenspeak。 它的用途是:通过SSH调用Qwen3-TTS生成语音 完整的 Skill 内容见:https://321skill.com/skills/qwenspeak-x-4/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请用预设的温柔女声,将这段产品介绍文案生成语音,语速适中,并保存为MP3文件。' 它会自动通过SSH连接Qwen3-TTS服务,选择对应声音,生成音频并返回下载链接。
介绍
【解决什么问题】当您需要将文本转化为自然流畅的语音、克隆特定人物的声音、或设计全新的声音音色时,qwenspeak 提供了一条简洁高效的路径。它基于通义千问3代TTS模型,通过SSH远程调用,无需本地部署大模型,即可获得高质量的语音合成结果。
【怎么用】您只需在AI对话中描述需求(如“用柔和的女声朗读这段文案”或“克隆这段录音里的声音”),qwenspeak 会自动通过SSH连接到配置好的Qwen3-TTS服务,选择合适的预设声音或启动声音克隆/声音设计流程,生成对应的音频文件并返回。整个过程无需手动操作服务器,由AI代理自动完成。
【适合谁】内容创作者(为视频、播客、有声书配音)、营销专员(批量生成广告语音)、视频剪辑师(快速为短片添加旁白)、以及任何需要将文本转化为语音的个人或团队。尤其适合需要远程调用TTS服务、且希望灵活控制声音风格(克隆、设计)的高级用户。
【使用建议】使用前请确保SSH连接配置正确(服务器地址、密钥等),并确认Qwen3-TTS服务已正常运行。对于声音克隆,需要提供清晰的人声样本(建议10秒以上)。注意:声音设计功能可能依赖特定的模型版本,建议定期更新服务端模型以获取最佳效果。
核心特点
与常见的本地TTS工具不同,qwenspeak 通过SSH远程调用Qwen3-TTS,支持声音克隆和声音设计,而不仅限于预设声音,适合需要定制化音色的场景。
注意事项
需要SSH访问权限和网络连接,无法在离线环境下使用;声音克隆效果依赖样本质量,短样本或嘈杂样本可能导致合成效果不佳。
常见问题
支持哪些预设声音?
目前支持多种性别、年龄、风格的预设声音,具体列表可在Qwen3-TTS服务端文档中查看,也可通过声音设计自定义新声音。
声音克隆需要提供多长的录音?
建议提供10秒以上的清晰人声录音,背景噪音越低越好,长度越长克隆效果越逼真。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/qwenspeak-x-4/raw/index.md 读取 qwenspeak 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/qwenspeak-x-4/raw/index.md(查看排版版本)