U2-audio-file-transcriber
通过云知声API将音频文件转写为文字
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:U2-audio-file-transcriber。 它的用途是:通过云知声API将音频文件转写为文字 完整的 Skill 内容见:https://321skill.com/skills/u2-audio-file-transcriber-x-3/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请将这份客服通话录音转写成文字,音频文件路径为/home/recordings/call20250301.mp3',它会自动调用云知声API进行语音识别,返回完整的通话文字记录,并标注说话人及时间戳。
介绍
本Skill解决的是将录制好的音频文件(如会议录音、客服通话、采访记录等)快速准确地转写成文字的需求。它通过调用UniCloud ASR(云知声语音识别)API,一键完成从音频到文本的转换,免去手动听写的繁琐过程。
使用非常简单:只需提供音频文件的路径或URL,Skill会自动识别语音并输出对应的文字内容。支持wav、mp3、m4a等多种常见音频格式,并针对金融、客服等领域的专业术语进行了优化,转写准确率更高。
适合需要大量处理音频转文字的用户,例如内容创作者将采访录音转化为文稿,客服人员记录通话内容,学术研究者整理访谈录音,以及法律、金融从业者转录会议记录等。
建议在上传音频前确保文件清晰、无过多背景噪音,以获得最佳转写效果。对于极长音频(如超过1小时),可能需要分段处理。注意本Skill仅支持离线文件转写,不适用于实时语音识别场景。
核心特点
相比通用语音转写工具,本Skill针对金融、客服领域做了专业术语优化,并支持更丰富的音频格式,准确率在同类UniCloud ASR工具中表现突出。
注意事项
不适合实时流式语音识别,仅支持处理已录制完成的音频文件,且对文件大小和时长有一定限制(具体取决于API配额)。
常见问题
支持哪些音频格式?
支持wav、mp3、m4a、ogg、flac等常见格式,具体请参考云知声API文档。
转写准确率如何?
正常清晰语音下准确率可达95%以上,对金融、客服领域的专业术语有额外优化,但受背景噪音、口音等因素影响会有所下降。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/u2-audio-file-transcriber-x-3/raw/index.md 读取 U2-audio-file-transcriber 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/u2-audio-file-transcriber-x-3/raw/index.md(查看排版版本)