Text to Speech — 20+ Languages, MP3 Output

面向AI智能体的多语言文本转语音API工具

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Text to Speech — 20+ Languages, MP3 Output。
它的用途是:面向AI智能体的多语言文本转语音API工具
完整的 Skill 内容见:https://321skill.com/skills/text-to-speech-20-languages-mp3-output/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'把这段欢迎词转换成法语的语音文件',它会调用TTS引擎合成对应法语语音,返回可直接播放的MP3音频及语言、时长信息。

对AI说:'帮我生成一段用于产品介绍的普通话语音',它会快速完成合成,直接输出可直接使用的base64编码MP3内容。

介绍

不少AI智能体落地时缺乏易用的语音输出能力,常面临支持语种有限、合成语音生硬不自然、输出格式无法直接播放、调用需提前申请复杂密钥等问题,难以快速搭建语音相关功能。 调用时仅需传入待转换文本与目标语言参数,工具会基于谷歌TTS引擎完成语音合成,直接返回base64编码的MP3格式音频、对应语言标识与音频时长,无需额外转码即可直接用于播放。 适合需要为AI智能体添加语音能力的开发者、做无障碍功能适配的产品团队、批量生成音频内容的内容创作者,以及搭建语音交互界面的软硬件项目团队。 使用前需确认Base L2链上的x402微支付状态正常,合成前可提前校验文本内容与目标语言的匹配度,避免出现发音偏差,大段文本可分段合成提升稳定性。

核心特点

无需申请API密钥,基于谷歌TTS引擎支持20余种语言,直接返回可即时播放的base64编码MP3,采用Base L2链上x402微支付按次结算,单次调用成本仅0.005美元。

注意事项

依赖谷歌TTS引擎能力,小众方言及超小语种支持不足,需通过Base L2链上微支付完成结算才可调用。

常见问题

调用该工具需要提前申请API密钥吗?

不需要,无需配置API密钥,通过Base L2链上x402微支付按次结算即可调用。

返回的音频可以直接播放吗?

可以,返回的是base64编码的MP3格式音频,无需额外转码即可直接播放。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/text-to-speech-20-languages-mp3-output/raw/index.md 读取 Text to Speech — 20+ Languages, MP3 Output 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。