Dlazy Audio Generate
根据提示词自动选择最佳TTS模型生成音频
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Dlazy Audio Generate。 它的用途是:根据提示词自动选择最佳TTS模型生成音频 完整的 Skill 内容见:https://321skill.com/skills/dlazy-audio-generate-x-2/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“请帮我生成一段3分钟的企业宣传片旁白,风格沉稳大气,语速中等偏慢,中文女声。”它会自动选择最合适的dlazy TTS模型,生成音频文件并返回下载链接。
介绍
Dlazy Audio Generate 是一款基于 dlazy CLI 的音频生成技能,能够根据你输入的提示词(如风格、语气、语速等)自动匹配最合适的语音合成(TTS)模型,快速生成高质量音频。无论是产品宣传旁白、课程讲解配音,还是短视频背景声,它都能帮你一站式搞定,无需手动挑选模型或参数。
使用非常简单:你只需用自然语言描述需要的音频内容及风格,例如“生成一段科技产品宣传旁白,语气专业、节奏适中”,技能会自动识别意图并调用最佳模型,直接输出音频文件。整个过程无需任何音频编辑经验,几秒钟即可完成。
这款技能特别适合内容创作者、视频剪辑师和营销专员。内容创作者可以用它快速为博客或播客生成配音;视频剪辑师能省去后期配音的繁琐流程;营销专员则能批量生成广告素材的音频部分,提升内容生产效率。
建议在使用时提供尽可能详细的描述,包括目标语言、性别偏好、情感基调等,以获得更精准的合成效果。当前版本主要面向中文和英文场景,对多语言混合输入或极长文本的支持有限,建议分段生成。
核心特点
与通用TTS工具不同,Dlazy Audio Generate 能根据提示词自动从多个 dlazy CLI 模型中选择最优方案,无需手动配置模型参数,真正做到“一句话生成”。
注意事项
不适合需要精细控制每个音素或情感表现力极高的专业配音场景,对生僻语种的识别能力有限。
常见问题
能生成中文语音吗?
可以,支持中文和英文,且能根据提示词自动选择该语言的最优模型。
生成的音频文件如何保存?
默认输出为标准音频文件(如WAV或MP3),可直接下载或通过链接获取。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/dlazy-audio-generate-x-2/raw/index.md 读取 Dlazy Audio Generate 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/dlazy-audio-generate-x-2/raw/index.md(查看排版版本)