@codexstar/pi-listen
为Pi CLI提供语音输入与输出功能
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:@codexstar/pi-listen。 它的用途是:为Pi CLI提供语音输入与输出功能 完整的 Skill 内容见:https://321skill.com/skills/codexstar-pi-listen/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'帮我列出当前目录下所有的JavaScript文件',它会通过语音播报识别您的指令,执行 `ls *.js` 命令后,再将结果用语音读给您听。您也可以继续按住说话追问:'把第一个文件的内容读出来',实现全程语音交互。
介绍
pi-listen 是一个为 Pi CLI 设计的语音交互增强工具,它解决了在命令行环境中需要频繁打字或希望实现语音控制的问题。通过简单的按键操作,用户即可通过语音输入指令,并接收语音反馈,让命令行操作更加直观和高效。
使用方式非常便捷。安装后,在 Pi CLI 中运行相应命令即可启动。用户只需按住预设的按键(如空格键)进行录音,松开后语音内容会被实时转录为文本并发送给 Pi AI 处理;AI 的回复则可以通过多种 TTS 引擎转换为语音播放出来,实现完整的语音对话循环。
这个工具非常适合那些希望提升命令行工作效率、有轻度肢体不便、或在多任务场景下(如开发调试时手被占用)仍需要与 AI 交互的用户。它也为喜欢语音交互或想为 Pi 项目添加语音接口的开发者提供了快速实现方案。
使用建议方面,首次使用前请根据 README 配置好所需的 STT(语音识别)和 TTS(语音合成)服务 API 密钥或本地模型。对于追求低延迟和隐私的用户,推荐优先尝试其支持的 19 种离线 STT 模型。注意,语音识别的准确性会受到环境噪音和口音的影响,在关键指令输入后建议核对一下文本。
核心特点
核心区别在于它集成了多达19种离线STT模型,无需网络即可实现高隐私的语音识别,同时提供了从轻量级(Kitten Nano)到高质量(Deepgram Aura)的多种TTS引擎选择,兼顾了离线可用性与云端音质。
注意事项
在环境嘈杂或用户有较重口音的情况下,离线语音识别的准确率可能会下降。
常见问题
如何切换不同的语音识别(STT)模型?
在配置文件中指定您想使用的 STT 服务商(如 Deepgram)或离线模型名称即可。
支持中文语音输入和输出吗?
支持,具体取决于您选择的 STT 和 TTS 模型是否支持中文,需要查阅相应模型的文档进行配置。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/codexstar-pi-listen/raw/index.md 读取 @codexstar/pi-listen 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/codexstar-pi-listen/raw/index.md(查看排版版本)