Galdr

将YouTube链接或本地音频转换为AI智能体可用的听者状态时序数据。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Galdr。
它的用途是:将YouTube链接或本地音频转换为AI智能体可用的听者状态时序数据。
完整的 Skill 内容见:https://321skill.com/skills/galdr-x-2/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘使用Galdr分析这段YouTube冥想音乐的链接,并告诉我听众的注意力集中度是如何随时间变化的。’,它会调用Galdr处理音频,生成包含注意力维度的时序追踪数据,并据此向你汇报注意力曲线的变化趋势,帮助你优化音频内容设计。

介绍

Galdr 是一个专为AI智能体设计的音频处理工具,它能够将YouTube视频链接或本地音频文件,转化为包含时间顺序的听者状态追踪数据。这些数据捕捉了音频流中随时间变化的多种状态维度,如脉冲、模式、注意力、压力、表面和谐等,为智能体理解和响应音频内容提供了结构化的输入。

使用Galdr时,用户只需提供音频源(在线链接或本地文件路径),工具便会自动处理音频,提取并输出一个按时间线排列的状态序列。这个过程通常通过命令行或API调用来完成,生成的追踪数据可以被集成到智能体的决策流程中,使其能够根据音频的实时状态变化做出反应。

该工具非常适合那些需要让AI智能体具备“听觉”感知能力的开发者,例如开发交互式游戏角色、智能客服、情绪感知应用或需要分析音频内容以触发特定行为的自动化流程。它降低了为智能体集成复杂音频分析能力的门槛。

在使用建议上,开发者应确保音频源的清晰度和可用性,以获得更准确的状态追踪。同时,需要将Galdr的输出与智能体的其他感知和决策模块进行有效集成,以构建完整的交互体验。由于它生成的是时序状态数据,因此对处理时序数据的编程能力有一定要求。

核心特点

与同类音频转文本工具不同,Galdr专注于生成描述听者心理或生理状态的时序数据(如注意力、压力),而非文字内容,为AI智能体提供了更直接、更结构化的情感或状态感知输入。

注意事项

不适合需要精确语音识别或文字转录的场景,其输出是抽象的状态追踪而非具体语义内容。

常见问题

Galdr支持哪些音频格式?

支持YouTube链接和常见的本地音频文件格式。

输出的‘听者状态追踪’数据是什么格式?

通常是包含时间戳和多种状态维度(如注意力、压力)数值的时序数据,具体格式需参考其文档。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/galdr-x-2/raw/index.md 读取 Galdr 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。