语音转写文字 的 AI Skill
共 108 个,按热度排序。把语音转写文字这件事交给 AI 来做。
Telegram Voice To Voice Macos
一款在 macOS 上处理 Telegram 语音消息的本地 AI 助手。
Telegram Voice To Voice Macos
一款在macOS上处理Telegram语音消息的本地AI助手。
Tencent MPS
腾讯云MPS音视频与图片处理AI工具
Telegram Voice To Voice Macos
一款在macOS上处理Telegram语音消息的本地智能助手。
Telegram Voice To Voice Macos
macOS上的Telegram语音助手,支持本地转录与AI语音回复
Telegram Voice To Voice Macos
一款在macOS上本地处理Telegram语音消息的智能助手。
Telegram Voice To Voice Macos
Telegram语音笔记本地转录+语音回复助手
Telegram Voice To Voice Macos
macOS上Telegram语音消息自动转录回复助手
Doubao ASR / 豆包语音转写
基于豆包ASR 2.0模型,提供专业级中文语音转写服务。
Speak AI
会议捕捉与媒体自动化工具
Speak AI
会议录音与AI洞察一站式工具
Speak AI
会议录音、转录、分析与自动化工作流工具
Speak AI
会议捕捉、录音搜索、语音视频调查与自动化
Speak AI
通过MCP管理会议、语音视频调查与剪辑的一站式工具集
Listen
修复语音转文字输入中的乱码和错误转录
Listen
修复语音转文本输入中的错误转录,提升语音输入准确性。
Listen
修复语音转文字输入中的错误转录,提升识别准确率。
Listen
修复语音转文字输入中的乱码和错误转录。
Listen
修复语音转文字输入中的错误转录
Listen
修复语音转写中的专有名词、数字和命令错误
Listen
修复语音转文字输入中的乱码和错误转录。
Dlazy Elevenlabs Stt
一款集成了 ElevenLabs scribe_v1 模型的语音转文字工具,支持多语言识别和说话人分离。
Dlazy Elevenlabs Stt
ElevenLabs语音转文字,支持自动语言检测与说话人分离
Dlazy Elevenlabs Stt
支持自动语言检测和说话人分离的高质量语音转文字工具。
Dlazy Elevenlabs Stt
一款支持自动语言检测和说话人分离的语音转文字工具。
Dlazy Elevenlabs Stt
基于ElevenLabs的语音转文字,支持自动语言检测和说话人分离。
Dlazy Elevenlabs Stt
ElevenLabs语音转文字,自动语言检测+说话人分离
Dlazy Elevenlabs Stt
基于ElevenLabs的高精度语音转文字工具,支持多语言识别和说话人分离。
Dlazy Elevenlabs Stt
ElevenLabs语音转文字,支持自动语言检测和说话人区分
Dlazy Fun Asr
阿里云百炼Fun-ASR录音转写,支持多语言与说话人分离
Dlazy Fun Asr
基于阿里云FunASR的录音转文字工具,支持多语言和说话人分离。
Dlazy Fun Asr
阿里云FunASR录音转写工具,支持多语言和说话人分离。
Dlazy Fun Asr
基于阿里云FunASR的录音转写工具,支持多语言及说话人分离。
Dlazy Fun Asr
阿里通义Fun-ASR录音转写,支持多语言与说话人分离。
Dlazy Fun Asr
阿里云百炼Fun-ASR录音转写,支持多语言与说话人分离
日语朗读作业批改模板
日语朗读作业AI批改,支持音频转写与CEFR分级评价
douyin-to-text
抖音/短视频转文字工具
日语会话测试批改
日语会话作业AI批改,支持语音转写与CEFR分级
日语会话测试批改
日语会话AI批改,语音转写+CEFR分级
日语会话测试批改
日语会话作业AI批改:语音转写、CEFR分级、纠错与成绩录入
日语会话测试批改
日语会话作业AI批改,支持语音转写与CEFR分级
U2-audio-file-transcriber
将音频文件转写为文字,支持多格式
U2-audio-file-transcriber
通过云知声ASR API,将音频文件转录为文本。
U2-audio-file-transcriber
音频文件转写为文字,支持金融、客服场景
U2-audio-file-transcriber
将音频文件转写为文字,支持多格式金融优化
U2-audio-file-transcriber
调用云知声API,将音频文件转写为文字
U2-audio-file-transcriber
通过云知声API将音频文件转写为文字
U2-audio-file-transcriber
通过云知声API将音频文件转录为文字
dy-caption
抖音/短视频一键转文字工具
Deyo
一键转写音频/视频文件为文字
Deyo
专为转录单个URL或本地音视频文件路径设计的转录工具。
Deyo
专为转录单个音频/视频URL或本地文件路径设计的工具。
Deyo
专为转录单个URL或本地音视频文件路径设计的AI工具。
Deyo
专为转录单个在线音视频URL或本地文件路径而设计的AI工具。
Deyo
音频/视频转写为文字,仅按需处理单个文件
Deyo
Deyo 音视频文件转文字工具
Deyo
专注处理单一音视频链接或本地文件路径的转录工具
Tencent MPS Intl.
腾讯云媒体处理MCP Skill
turbo-whisper-local-stt
本地高性能中文音频转文字,离线隐私安全
turbo-whisper-local-stt
本地高性能、隐私安全的音频转文字工具
turbo-whisper-local-stt
本地高性能、中文优先的音频转文字工具,完全离线运行。
turbo-whisper-local-stt
完全离线的本地高性能音频转文字工具
turbo-whisper-local-stt
本地高性能音频转文字,完全离线,专注中文场景。
turbo-whisper-local-stt
本地离线、中文优先的音频转文字工具
turbo-whisper-local-stt
本地高性能中文音频转文字工具
turbo-whisper-local-stt
本地离线高性能中文音频转文字
melo-tts-metadata-creator
自动生成 MeloTTS 训练所需的 metadata.list 文件
melo-tts-metadata-creator
为MeloTTS训练自动生成metadata.list文件
melo-tts-metadata-creator
为 MeloTTS 训练生成 metadata.list 的元数据工具
melo-tts-metadata-creator
为 MeloTTS 训练自动生成 metadata.list 文件
jianying-subtitle
调用剪映免费API的音频视频转字幕CLI工具
talkies
自托管的OpenAI兼容语音服务,集成多种ASR与TTS模型。
melo-tts-metadata-creator
自动生成 MeloTTS 训练所需的 metadata.list
talkies
自托管OpenAI兼容语音服务,支持多模型ASR/TTS
talkies
自托管OpenAI兼容语音服务,支持ASR与TTS
talkies
自托管OpenAI兼容语音服务,ASR与TTS
talkies
自托管OpenAI兼容语音识别与合成服务
talkies
自托管、兼容OpenAI API的语音转写与合成服务。
talkies
自托管、兼容OpenAI API的语音转文字与文字转语音服务
talkies
自托管开源语音服务,兼容OpenAI API
Wecom Voice Agent
企业微信语音智能助手,说话即可完成日程、待办、天气和消息处理
@maddeye/pi-voice
为Pi提供本地、跨平台的私有语音输入
baocut
让AI编码助手驱动BaoCut视频处理工具
claude-skill-video-transcribe
一站式视频音频转录与核心要点提炼工具
@dtmirizzi/pi-openrouter-multimodal
为Pi AI提供多模态能力的OpenRouter工具集
@brngp/pi-voice
按住空格键进行语音听写的Pi插件
pi-sense
为纯文本AI模型添加本地多媒体理解能力
小红书视频深度总结(本地)
本地免费一键深度总结小红书视频笔记
hellomedia
为AI宿主提供独立的多模态(图/视/音)处理能力
Claude-Skill-for-Multimodal-Report-Generation
将零散会议材料自动整理成结构化Word报告
Fast
支持批量处理的高性能语音识别MCP服务器。
podcast-transcribe
从播客RSS源下载音频并转录为文本,生成内容摘要。
assemblyai-cli
基于Rust的AssemblyAI音视频转录命令行工具与AI Agent技能。
audio-transcriber
支持多说话人识别与LLM润色的音频转录Claude插件
asr
一个通用的自动语音识别(ASR)工具,可将音频转换为文字。
claude-telegram-supercharged
一个功能远超官方版本的Claude Telegram插件,支持语音对话、文件处理等
douyin-video-summary
一键解析抖音视频链接,提取音频并生成结构化文字总结。
faster-whisper
基于本地GPU加速的音频转录工具,速度比原版Whisper快4-6倍。
maxgent-plugin
一个集成了媒体生成、浏览器自动化和开发者工作流技能的Claude插件合集。
mindwork
一款用于治疗会话分析与个人日记的AI工具,帮助用户从音频和文字记录中提取洞察。
openai-api
一站式集成 OpenAI 官方 API 的 AI 应用开发指南
speak
让AI开口说话,提供语音交互能力
together-api
一站式集成Together AI API,调用200+开源模型进行推理。
veniceai/venice-audio-speech
一个用于生成和处理音频的AI工具库
veniceai/venice-audio-transcription
基于Whisper的音频转文字工具,支持多种格式。
vibe-ops-plugin
为运维团队打造的Claude技能合集,涵盖多媒体处理与macOS应用安装。
video-editing-skill
AI 视频剪辑流水线,专为口播/教程/访谈等社媒短视频生产
voxtype
Linux本地语音转文字工具,支持多种引擎,实时转录。