pi-voice-stt
为 Pi TUI 提供跨服务商的语音转文字听写功能。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:pi-voice-stt。 它的用途是:为 Pi TUI 提供跨服务商的语音转文字听写功能。 完整的 Skill 内容见:https://321skill.com/skills/pi-voice-stt/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“开始听写”,它会启动录音并将你说的话实时转换成文字,显示在 Pi TUI 的当前输入行中。例如,在编写 Git 提交信息时,你可以直接口述“修复了用户登录时的空指针异常”,该文本便会自动填入提交信息框,无需手动键入。
介绍
pi-voice-stt 是一个专为 Pi TUI 设计的语音转文字扩展,它解决了用户在命令行界面(TUI)中需要快速、便捷地进行语音输入的问题。传统的文本输入在 TUI 中可能效率较低,尤其在需要口述长段内容或不便打字的场景下,该扩展通过集成语音识别服务,让用户能够“动口不动手”地完成输入。
使用该技能非常简单。首先,确保你的环境中已安装 Pi TUI。然后,通过 npm 安装 pi-voice-stt 包。在 Pi TUI 中激活该扩展后,你可以通过预设的快捷键或语音命令触发录音,系统会将你的语音实时转换为文本,并插入到当前光标位置或指定的输入区域。它支持配置不同的后端语音识别提供商,以适应不同的网络环境或准确度需求。
这个技能非常适合需要在命令行环境中高效工作的开发者、系统管理员、技术写作者,或者任何希望减少键盘操作、通过语音提升在终端中交互效率的用户。对于经常需要记录日志、编写代码注释、填写表单或进行快速笔记的人来说,它能显著提升工作流的速度和便利性。
使用建议方面,请确保你的麦克风设备正常工作,并在网络连接良好的环境下使用以获得最佳的识别速度和准确率。由于它依赖外部语音识别服务,请注意隐私和数据安全,根据所选服务商的条款了解语音数据的处理方式。初次使用时,建议进行简短的测试以调整麦克风灵敏度和熟悉触发命令。
核心特点
其核心区别在于它是“Provider-agnostic”(服务商无关)的,允许用户灵活配置和切换不同的底层语音识别服务(如 Google Cloud Speech-to-Text、Azure Cognitive Services 等),而不被锁定在单一提供商,这提供了更好的可定制性和对识别质量/成本的控制。
注意事项
该技能不适合在噪音极大、网络不稳定或对语音识别隐私有极端要求的离线场景下使用。
常见问题
pi-voice-stt 支持哪些语音识别服务?
它设计为服务商无关,理论上可配置支持任何提供 API 的语音识别服务,具体需查看扩展配置文档。
在 Pi TUI 中如何触发语音输入?
通常通过预设的快捷键或特定的语音唤醒词触发,具体方式需在扩展设置中查看或配置。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/pi-voice-stt/raw/index.md 读取 pi-voice-stt 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/pi-voice-stt/raw/index.md(查看排版版本)