Telegram Voice To Voice Macos
一款在macOS上处理Telegram语音消息的本地AI助手。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Telegram Voice To Voice Macos。 它的用途是:一款在macOS上处理Telegram语音消息的本地AI助手。 完整的 Skill 内容见:https://321skill.com/skills/telegram-voice-to-voice-macos-x-6/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“帮我设置Telegram语音助手,监听我和家人的群聊。”,它会引导你配置API密钥并启动服务。之后,当你在群聊中发送一条语音说“晚上想吃什么?”,助手会自动将其转为文字,生成如“吃火锅怎么样?”的回复,并以语音消息形式发送到群里。
介绍
这款Skill旨在解决用户在macOS(特别是Apple Silicon芯片设备)上处理Telegram语音消息的繁琐问题。它能够自动将收到的语音消息(OGG/Opus格式)在本地转录为文字,利用AI生成回复,并最终将回复以语音消息的形式发送回Telegram,实现语音对语音的完整对话闭环。
使用方式是通过命令行运行。用户配置好Telegram API密钥后,该工具会监听指定的Telegram对话。当收到语音消息时,它会调用本地的Speech框架进行语音识别,将文本传递给AI模型(如Claude)生成回复,再通过系统自带的say命令和ffmpeg工具将回复文本合成为音频文件,并发送回对话中。整个过程在本地完成,无需依赖云端语音服务。
它非常适合需要在Telegram上进行高效语音沟通,但又希望保护隐私、减少手动转录和打字负担的用户。例如,经常通过Telegram语音沟通的远程工作者、内容创作者,或者希望为长辈提供更便捷语音交互方式的开发者。
使用建议是确保你的macOS系统版本较新,并已安装必要的命令行工具(如ffmpeg)。由于依赖本地Speech框架进行识别,其准确度可能受口音和背景噪音影响。对于需要极高识别准确率的场景,可能需要结合其他方案。同时,注意管理好Telegram API的使用配额,避免频繁调用导致限制。
核心特点
核心区别在于其完全本地的处理流程和针对macOS Apple Silicon的深度优化。它不依赖任何云端语音识别或合成API,使用系统内置的Speech.framework和`say`命令,在保护用户隐私的同时实现了端到端的语音对话自动化,且专为苹果芯片的性能做了适配。
注意事项
仅支持macOS系统(特别是Apple Silicon),且语音识别质量完全依赖于本地Speech框架,对非标准口音或嘈杂环境下的语音支持可能有限。
常见问题
这个工具需要联网吗?
需要联网。语音转文字在本地完成,但生成回复需要调用AI模型的API(如Claude),发送和接收Telegram消息也需要网络。
支持哪些语言的语音识别和合成?
语音识别依赖macOS自带的Speech框架,支持多种语言,但具体取决于系统设置。语音合成使用`say`命令,也支持多语言,需在命令中指定。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/telegram-voice-to-voice-macos-x-6/raw/index.md 读取 Telegram Voice To Voice Macos 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/telegram-voice-to-voice-macos-x-6/raw/index.md(查看排版版本)