Dlazy Audio Generate

自动选最优模型的音频/TTS生成技能

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Dlazy Audio Generate。
它的用途是:自动选最优模型的音频/TTS生成技能
完整的 Skill 内容见:https://321skill.com/skills/dlazy-audio-generate-x-4/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'生成一段产品介绍音频,语气活泼,时长30秒,背景用轻快的钢琴曲。' 它会自动选择最合适的TTS模型和音乐生成模型,先合成语音,再叠加背景音乐,最后输出一个完整的MP3文件。

介绍

Dlazy Audio Generate 是一个专注于音频生成的 AI 技能,核心价值在于免去手动挑选模型的麻烦。它根据用户输入的提示词,自动从 dlazy CLI 所支持的音频/TTS 模型中选出最合适的那个,无论是需要自然流畅的语音合成、带有情感色彩的朗读,还是特定风格的音效生成,都能一次完成。

使用方式非常简单:你只需告诉它“生成一段介绍产品的语音,语气要亲切”或“为这段文字配上男中音朗读”,它就会自动调用 dlazy CLI 的底层能力,返回高质量音频文件。整个过程无需任何手动配置模型参数,也无需了解不同 TTS 模型的技术细节。

适合内容创作者、视频剪辑师、营销专员、教育工作者等需要快速生成配音或音效的用户。尤其适合批量制作短视频旁白、课程讲解音频、宣传片配音、有声读物等场景,能大幅缩短音频制作周期。

建议在提示词中明确音频风格、语速、情感倾向等细节,以获得更精准的效果。注意该技能依赖 dlazy CLI 环境,使用前需确保已安装并配置好 CLI 工具。对于需要实时流式音频或超低延迟的场景,可能不是最佳选择。

核心特点

与通用 TTS 技能不同,Dlazy Audio Generate 能根据提示词自动切换模型(如情感语音、标准朗读、多语种),无需用户手动指定模型名称,也无需记忆不同模型的参数。

注意事项

不适合需要实时流式音频输出或超低延迟的交互场景,且依赖 dlazy CLI 的本地安装与配置。

常见问题

支持中文语音吗?

支持,只要提示词中包含中文,技能会自动选择支持中文的 TTS 模型。

需要安装什么依赖?

需要先安装 dlazy CLI 工具,推荐使用 npm install -g dlazy 全局安装。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/dlazy-audio-generate-x-4/raw/index.md 读取 Dlazy Audio Generate 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。