Dlazy Audio Generate
根据提示词自动选择最佳音频/TTS模型
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Dlazy Audio Generate。 它的用途是:根据提示词自动选择最佳音频/TTS模型 完整的 Skill 内容见:https://321skill.com/skills/dlazy-audio-generate-x-7/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'生成一段30秒的励志男声旁白,用于产品宣传视频,背景音乐要激昂',它会自动选择最合适的TTS模型和音效模型,输出一段完整的音频文件。
对AI说:'为我的历史科普视频生成一个沉稳的老年女声配音',它会自动匹配语音风格并生成对应的音频。
介绍
在内容创作、营销推广或教学演示中,经常需要生成高质量的语音或音效,但手动选择不同的TTS模型或音频生成工具既繁琐又耗时。Dlazy Audio Generate 技能专门解决这一痛点:它能够根据你的提示词,自动从 dlazy CLI 提供的多个音频/TTS 模型中挑选最合适的一个,一键生成所需的音频内容。
使用方式非常简单:你只需输入描述性提示词,比如“生成一段温暖的女声旁白,用于产品宣传片”或“制作一个科幻风格的背景音效”,该技能就会自动分析需求,调用最佳的底层模型,并返回可直接使用的音频文件。整个过程无需你手动切换模型或调整参数。
这个技能尤其适合内容创作者、营销专员和视频剪辑师。无论你是需要为短视频配旁白、为课程制作讲解音频,还是为游戏或广告生成特殊音效,它都能帮你节省大量筛选和测试模型的时间。
建议在使用时尽量提供清晰的风格、语调、语速等描述,以便模型更精准地匹配。注意,该技能依赖 dlazy CLI 环境,需要提前安装并配置好相关依赖。生成的音频质量受底层模型能力限制,对于极高要求的专业级录音可能仍需后期处理。
核心特点
与普通单一TTS技能不同,Dlazy Audio Generate 能根据提示词语义自动切换模型(如情感语音、多语言TTS、音效生成等),无需用户手动指定模型名称,实现“一句话生成”的极致体验。
注意事项
不适合需要精细控制每个音频参数(如音高、响度、混响)的专业音频制作场景,也不适合需要离线或低延迟的实时语音交互。
常见问题
这个技能支持哪些语言?
支持多种语言,具体取决于 dlazy CLI 内置的模型,通常包括中文、英文、日文等常见语言,建议在提示词中指定语言以获得最佳效果。
生成的音频文件格式是什么?
默认输出为 MP3 或 WAV 格式,具体可通过参数调整。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/dlazy-audio-generate-x-7/raw/index.md 读取 Dlazy Audio Generate 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/dlazy-audio-generate-x-7/raw/index.md(查看排版版本)