Speak
将文本转换为自然语音就绪输出
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Speak。 它的用途是:将文本转换为自然语音就绪输出 完整的 Skill 内容见:https://321skill.com/skills/speak-x-9/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请将这段产品发布会讲稿转换为适合TTS朗读的格式,使用美式英语、中等语速,确保正确念出“OpenAI”和“GPT-4”,并去除所有括弧内的注释文本。' Speak 会输出规范化后的文本,包含韵律标记和发音提示,直接复制到任何TTS引擎即可获得自然流畅的语音。
介绍
Speak 是一个专注于文本转语音预处理的工具,它解决的是 TTS 引擎输出不自然、读错发音、语速和口音不匹配等问题。当你需要将一段文字(如通知、脚本、对话)交给 TTS 朗读时,Speak 会先对文本进行规范化处理(去除 Markdown、URL、代码等),自动调整韵律和发音,并允许你指定语音偏好(语速、口音、人名发音等),最终输出一段可直接送入任何 TTS 引擎的“语音就绪文本”。
使用方式非常简单:将原始文本输入 Speak,它会返回优化后的版本。你可以在其中加入诸如“用美式英语、中等语速、正确念出’OpenAI’”等指令,工具会自动处理剩余工作。它支持多种语言和自定义发音词典,确保专业术语、数字、日期、缩写等都能准确朗读。
Speak 特别适合内容创作者、文档工程师、视频剪辑师以及任何需要生成高质量语音旁白的用户。无论是制作宣传短片、课程讲解演示 PPT,还是为虚拟助手撰写对话轮次,只要你的最终输出会被朗读出来,Speak 就能显著提升听感,避免机器人般的生硬效果。
使用建议:在调用 Speak 之前,请确保原始文本已经过基础校对;对于极长的文本(如整本书),建议分段处理以获得最佳韵律效果。注意,Speak 不适用于语音识别(ASR)或实时双向通话场景,它仅负责文本到语音就绪格式的转换,不直接生成音频文件。
核心特点
与同类 TTS 优化工具相比,Speak 专注于文本层面的预处理(规范化、韵律标记、发音修正),而不是直接生成音频,因此可以无缝适配任何 TTS 引擎(如 ElevenLabs、Google TTS、Azure TTS 等),让你在保留自己偏好的 TTS 引擎的同时获得更自然的朗读效果。
注意事项
不适用于语音转文字(ASR)或实时双向通话场景。
常见问题
支持中文吗?
支持,Speak 可处理中文文本并进行中文发音优化,同时支持中英文混排场景。
如何设置语音偏好?
在输入文本时直接添加指令,例如“用英式英语、慢速朗读,注意强调关键词”即可。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/speak-x-9/raw/index.md 读取 Speak 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/speak-x-9/raw/index.md(查看排版版本)