mcp-tts

为Claude Desktop等工具添加多引擎文本转语音能力

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:mcp-tts。
它的用途是:为Claude Desktop等工具添加多引擎文本转语音能力
完整的 Skill 内容见:https://321skill.com/skills/mcp-tts/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“请把这段项目总结用‘nova’声音读给我听。”,它会调用 `openai_tts` 工具,使用清晰、略带正式感的‘nova’音色将文本转换为语音播放。或者,在写代码时

对AI说:“用‘say_tts’朗读一下我刚写的这个函数注释,帮我检查下表述是否通顺。”,AI会调用系统内置语音进行朗读。

介绍

mcp-tts是一个MCP服务器,它解决了AI助手(如Claude Desktop、Cursor IDE)无法直接语音播报回复内容的问题,让交互体验从纯文本升级为可听可读。

它通过注册四个独立的TTS工具(say_tts, elevenlabs_tts, google_tts, openai_tts),将文本转换为语音播放。用户可以在AI助手的对话中直接调用这些工具,选择不同的语音引擎和音色来播报任何文本内容,例如让AI朗读它自己生成的回复、文章或代码注释。

这个Skill非常适合需要多感官接收信息或进行演示的用户,比如内容创作者需要预览文案的朗读效果,或高校学生在学习时希望AI助手能朗读外文资料辅助理解。对于视觉疲劳的开发者,听代码逻辑也是一种休息方式。

使用前请注意,部分引擎(如ElevenLabs、OpenAI)需要配置相应的API密钥。默认情况下,服务器会强制顺序播放语音,以防止多个语音同时播放造成混乱,但你也可以通过环境变量或命令行参数启用并发模式。

核心特点

核心区别在于集成了四大主流TTS引擎于一体,并提供了系统级的语音播放队列管理,能有效防止在多实例或高并发场景下语音重叠播放的混乱问题。

注意事项

不适合在需要极低延迟或完全离线(且无法使用macOS `say`命令)的环境下使用。

常见问题

如何让多个Claude Desktop实例同时播放语音?

设置环境变量 `MCP_TTS_ALLOW_CONCURRENT=true` 或启动时添加 `--sequential-tts=false` 参数,但请注意这可能导致语音重叠。

使用Google或OpenAI的TTS需要付费吗?

需要,使用 `google_tts` 和 `openai_tts` 工具需要你拥有对应平台的账户并配置API密钥,会产生相应的API调用费用。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/mcp-tts/raw/index.md 读取 mcp-tts 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。