Telegram Voice To Voice Macos

一款在macOS上处理Telegram语音消息的本地智能助手。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Telegram Voice To Voice Macos。
它的用途是:一款在macOS上处理Telegram语音消息的本地智能助手。
完整的 Skill 内容见:https://321skill.com/skills/telegram-voice-to-voice-macos-x-5/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“帮我设置Telegram语音助手,监听‘家庭群’的语音消息并自动回复。”,它会引导你配置API密钥和监听规则。之后,当你在‘家庭群’里发送一条语音说“晚上想吃什么?”,助手会将其转录为文字,生成如“我想吃火锅”的回复,并合成语音消息发送到群里。

介绍

这款Skill旨在解决macOS用户(尤其是Apple Silicon机型)在Telegram中高效处理语音消息的痛点。它能够自动将收到的语音消息(OGG/Opus格式)在本地转录为文字,利用AI生成回复,并最终将回复以语音消息的形式发送回Telegram,整个过程无需依赖云端服务,保护了用户隐私。

使用时,你需要配置好Telegram API密钥,并确保macOS系统版本支持Speech框架。Skill会监听指定的Telegram对话,当收到语音消息时,会自动调用本地的yap工具和Speech.framework进行语音识别,然后根据识别出的文本内容生成回复。生成的回复文本可以通过macOS自带的say命令和ffmpeg工具合成为音频文件,再通过Telegram API发送出去。

它非常适合需要频繁使用Telegram语音功能进行沟通,但又希望保持对话私密性、或网络环境不佳无法使用云端语音识别的用户。例如,远程工作者、自由职业者、以及注重隐私的商务人士。

使用建议:由于依赖本地的Speech框架进行语音识别,其准确率可能因口音、背景噪音等因素而异。建议在相对安静的环境下使用,并可以先进行简单的识别测试。同时,确保你的macOS系统已更新至较新版本,以获得最佳的Speech框架支持。

核心特点

核心区别在于完全本地化处理Telegram语音消息的完整流程(转录、生成回复、再合成语音),无需将任何音频数据上传至云端,在保护隐私的同时,为Apple Silicon Mac提供了开箱即用的集成方案。

注意事项

仅支持macOS(特别是Apple Silicon芯片),且语音识别依赖本地Speech框架,对非标准口音或嘈杂环境下的语音识别准确率可能有限。

常见问题

支持Windows或Linux吗?

不支持,这是一个专门为macOS(尤其是Apple Silicon)设计的工具。

语音识别的准确率如何?

依赖macOS自带的Speech框架,在安静环境下对标准普通话或英语有较好识别率,但可能受口音和背景音影响。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/telegram-voice-to-voice-macos-x-5/raw/index.md 读取 Telegram Voice To Voice Macos 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。