Speak

将文本转化为自然语音就绪输出

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Speak。
它的用途是:将文本转化为自然语音就绪输出
完整的 Skill 内容见:https://321skill.com/skills/speak-x-3/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'请将这篇文章摘要转换为适合语音播报的文本,正确朗读作者名“张骞”和数字“2025年3月12日”,并适当添加停顿。',它会输出归一化后的文本,标注了发音提示和韵律标记,如“张骞(zhāng qiān)”、“2025年3月12日 → 二零二五年三月十二日”,并插入句间停顿符号。

介绍

解决什么问题:TTS(文本转语音)引擎常因原始文本中包含Markdown符号、URL、代码、拼写异常的数字/日期/缩写,或缺乏韵律标记和发音规范,导致生成机器人化、语速不当或发音错误的音频。Speak 通过文本归一化、韵律标注、发音校正和音色偏好设置,将输入文本预处理为任何 TTS 引擎都能直接输出的自然语音就绪内容。

怎么用:向 AI 提供需要朗读的文本(如语音通知、旁白脚本、对话轮次),Speak 会自动清洗 Markdown 标记、展开简写、标准化数字和日期格式,并添加韵律标记(如停顿、重音)和发音提示(如人名、专业术语)。输出结果可直接粘贴到 TTS 引擎,或作为语音通道的输入。

适合谁:内容创作者(制作有声内容、播客)、视频剪辑师(为配音旁白优化文本)、智能体开发者(为语音对话系统准备自然对话流)、营销专员(生成语音通知或广告配音)。

使用建议:适用于最终需要朗读的文本场景,尤其当现有 TTS 输出机械感明显时。注意:本身不生成音频,也不支持语音识别或实时双向通话。建议在生成后先试听一小段,确保发音和韵律符合预期。

核心特点

同类工具多直接对接单一 TTS 引擎,而 Speak 输出是引擎无关的标准化文本,同时提供深度的韵律和发音控制,而非简单替换规则。

注意事项

不适用于语音转文字、实时双向通话或需要直接生成音频文件的场景。

常见问题

Speak 能直接生成MP3音频吗?

不能,它输出的是经过优化的文本,需要配合任何 TTS 引擎(如 Amazon Polly、Google TTS)才能生成音频。

支持中文吗?

支持,它会对中英文混排、数字、日期、缩写进行统一归一化处理,并支持声调标注。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/speak-x-3/raw/index.md 读取 Speak 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。