Telegram Voice To Voice Macos

一款在macOS上本地处理Telegram语音消息的智能助手。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Telegram Voice To Voice Macos。
它的用途是:一款在macOS上本地处理Telegram语音消息的智能助手。
完整的 Skill 内容见:https://321skill.com/skills/telegram-voice-to-voice-macos-x-2/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘帮我设置Telegram语音助手,并启用语音回复模式。’,它会引导你完成环境配置和机器人Token设置。之后,当你向绑定的Telegram机器人发送一条语音消息说‘今天有什么新闻摘要?’,它会先在本地将语音转为文字,然后生成一段新闻摘要文本,最后用语音朗读出来并发送回你的Telegram。

介绍

这款Skill旨在解决用户在macOS Apple Silicon设备上处理Telegram语音消息不便的问题。它能够自动将接收到的OGG/Opus格式语音消息在本地转录为文字,利用AI生成回复,并可将回复文本合成为语音消息发送回去,支持语音或纯文本回复模式。

使用方式是通过配置好的Telegram机器人账号。当用户向该账号发送语音消息时,Skill会调用本地的yap工具和Speech.framework进行语音识别,然后将识别出的文本交由AI模型(如Claude)生成回复内容。如果选择语音回复模式,则会使用macOS的say命令和ffmpeg工具将回复文本转换为音频文件,并发送回Telegram对话中。

它非常适合需要频繁处理Telegram语音消息的macOS用户,特别是那些注重隐私、希望所有语音处理都在本地完成,或者网络环境不佳、需要离线处理语音内容的用户。例如,内容创作者、远程工作者或社媒运营人员,他们可以通过语音快速记录灵感或接收反馈,并通过AI助手高效回复。

使用建议是确保你的macOS系统版本支持Speech.framework,并且已安装必要的命令行工具(如ffmpeg)。由于依赖本地语音识别,其准确度受限于系统语言支持和个人发音清晰度。在处理敏感信息时,其本地处理的特性是一个优势,但需注意AI生成回复的内容仍需人工审核,避免不当言论。

核心特点

核心区别在于其完全本地的语音处理流水线,利用macOS原生的Speech.framework进行语音识别,无需将音频数据上传至云端,在保护隐私的同时实现了快速的语音转文字和回复生成。

注意事项

仅支持macOS Apple Silicon设备,且语音识别准确度依赖于系统语言包和用户发音。

常见问题

支持哪些语言的语音识别?

依赖macOS系统Speech.framework支持的语言,通常包括主流语言如英语、中文等,具体需查看系统设置。

回复的AI模型可以更换吗?

可以,Skill通常通过API调用AI模型(如Claude),理论上可以配置为支持相同API的其他模型。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/telegram-voice-to-voice-macos-x-2/raw/index.md 读取 Telegram Voice To Voice Macos 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。