Dlazy Fun Asr
阿里云FunASR录音转写工具,支持多语言和说话人分离。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Dlazy Fun Asr。 它的用途是:阿里云FunASR录音转写工具,支持多语言和说话人分离。 完整的 Skill 内容见:https://321skill.com/skills/dlazy-fun-asr-x-4/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
‘帮我把这个会议录音转成文字,并区分一下王总和李经理的发言。’,它会调用Fun-ASR模型处理音频,生成带说话人标签的完整文字稿。或者
对AI说:‘为这段产品介绍视频生成中文字幕。’,它会自动识别视频中的语音并输出时间轴对齐的字幕文件。
介绍
Dlazy Fun Asr Skill 主要解决音频内容转录为文字的效率问题。无论是会议录音、访谈记录还是课程录像,它都能快速、准确地生成文字稿,省去人工听写的繁琐。
使用时,您只需提供音频文件或录音链接,该Skill便会调用阿里云百炼Fun-ASR模型进行自动语音识别。它支持中文、英文等多种语言,并能自动检测音频中的语言类型。同时,它还具备说话人分离功能,可以区分不同说话者的内容,使转录结果更加清晰有条理。
该Skill非常适合内容创作者、学术研究者、客服人员以及需要频繁处理音频材料的各类专业人士。例如,视频博主可以用它生成字幕,研究人员可以用它整理访谈资料,客服团队可以用它分析通话记录。
建议在使用前确保音频质量清晰,背景噪音较少,以获得最佳的转录效果。对于专业术语较多的领域,转录后可能需要进行少量的人工校对。同时,请注意保护音频中可能涉及的隐私信息。
核心特点
核心区别在于集成了阿里云百炼的Fun-ASR模型,不仅支持多语言自动检测,还内置了说话人分离功能,能在一次处理中同时完成转写和区分不同讲话者,无需额外步骤。
注意事项
不适合实时语音转写或处理背景噪音极大、口音极重的音频。
常见问题
支持哪些音频格式?
支持常见的MP3、WAV等格式,具体可参考Fun-ASR官方文档。
说话人分离准确吗?
在对话清晰、说话人音色差异明显的场景下效果较好,复杂场景可能需人工辅助。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/dlazy-fun-asr-x-4/raw/index.md 读取 Dlazy Fun Asr 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/dlazy-fun-asr-x-4/raw/index.md(查看排版版本)