Speak
将文本转换为自然、语音友好的格式,优化TTS发音效果。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Speak。 它的用途是:将文本转换为自然、语音友好的格式,优化TTS发音效果。 完整的 Skill 内容见:https://321skill.com/skills/speak-x/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“为我的智能家居应用写一条欢迎语音通知,内容是‘下午好,主人。室内温度26度,湿度50%,空气质量良好。’,并优化成适合TTS朗读的格式。” 它会生成一段添加了适当停顿、重音和数字读法标记的文本,例如“下午好,<break time="200ms"/>主人。室内温度<say-as interpret-as="cardinal">26</say-as>度,湿度<say-as interpret-as="cardinal">50</say-as>%,空气质量良好。”,确保TTS引擎能自然流畅地播报。
介绍
Speak Skill 旨在解决文本转语音(TTS)引擎输出效果生硬、不自然的问题。当AI生成的回复需要被大声朗读、发送到语音频道,或用于制作画外音脚本、语音简报、通知和对话时,原始文本中的特殊符号、缩写、数字、代码等元素常常导致TTS发音错误、节奏不当或口音不符。
该Skill通过一系列文本预处理和标记技术来优化文本。它能对文本进行标准化处理,调整韵律(如停顿、重音),修正特定词汇的发音,并允许用户指定语音偏好(如语速、口音)。用户只需将需要朗读的文本交给集成了此Skill的AI,即可获得一份“语音就绪”的优化文本,直接供任何TTS引擎使用。
它非常适合需要高质量语音输出的内容创作者、开发语音交互应用的工程师、制作教学或演示材料的讲师,以及任何对AI语音播报效果有更高要求的普通用户。无论是制作播客脚本、语音助手回复,还是优化系统通知的听觉体验,都能从中受益。
使用建议是,在明确输出将用于语音播报时激活此Skill。需要注意的是,它仅用于优化文本输入以提升TTS效果,本身不提供语音合成或语音识别功能,也不适用于搭建实时双向通话系统。
核心特点
与单纯生成文本的Skill不同,它专门针对TTS引擎的输入进行深度优化,内置了文本标准化、韵律标记和发音校正规则,能系统性地解决TTS读代码、读链接、误读专有名词等具体痛点,产出的是可直接喂给TTS的“语音就绪”格式文本。
注意事项
不适用于语音转文本(STT)或搭建实时双向语音通话系统。
常见问题
这个Skill能直接生成语音吗?
不能,它只优化文本格式,你需要将优化后的文本输入到独立的TTS引擎中合成语音。
它能纠正任何单词的发音吗?
可以,它支持通过特定标记(如SSML或自定义发音词典)来指导TTS引擎如何读出特定名称、缩写或专业术语。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/speak-x/raw/index.md 读取 Speak 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/speak-x/raw/index.md(查看排版版本)