Galdr
将YouTube链接或本地音频转为听众状态轨迹
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Galdr。 它的用途是:将YouTube链接或本地音频转为听众状态轨迹 完整的 Skill 内容见:https://321skill.com/skills/galdr-x-3/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'帮我分析这段YouTube音乐视频的听众情绪变化,输出每5秒的注意力、压力等状态数据。' 它会自动下载视频音频,通过Galdr处理生成时间序列,并以折线图形式展示注意力高峰和情绪波动点。
介绍
Galdr 是一个专门为 AI 代理设计的工具,它能够将 YouTube 视频链接或本地音频文件转换为带有时间顺序的听众状态轨迹。这些轨迹包含脉搏、注意力模式、情绪压力、频谱表面和谐度等多维特征,帮助 AI 理解音频内容对听众的实时影响。
使用非常简单:你只需提供 YouTube 链接或本地音频路径,Galdr 会自动下载并处理音频,输出一个结构化的 JSON 或 CSV 时间序列数据。你可以直接将这些数据输入到其他 AI 代理或分析管道中,用于后续的注意力分析、情绪追踪、节奏检测等场景。
本工具适合内容创作者(分析视频/音频的观众反应)、数据分析师(处理时序数据)、学术研究者(研究听众注意力与情绪变化),以及任何需要将音频内容量化为可计算状态序列的开发者。
建议在使用前确保音频质量清晰,避免背景噪音干扰。对于极长的音频(超过 2 小时),处理时间可能较长,建议分段处理。此外,Galdr 目前主要针对音乐和语音内容优化,对于纯环境音效的效果可能有限。
核心特点
同类工具多只做情感标签或语音转文字,Galdr 则输出包含脉搏、注意力、压力等多维听众状态的时间序列,粒度更细,更适合 AI 代理进行动态决策和上下文感知。
注意事项
不适合需要高精度语音转文字或逐字转录的场景,且对音频质量有一定要求,环境噪声可能影响状态提取准确度。
常见问题
Galdr 支持哪些音频格式?
支持常见格式如 MP3、WAV、FLAC、M4A 等,YouTube 链接会自动下载为音频。
输出的听众状态数据如何用于 AI 代理?
数据以时间戳为索引,包含 pulse、attention、pressure 等字段,可直接作为 RAG 检索的上下文或用于构建用户状态跟踪系统。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/galdr-x-3/raw/index.md 读取 Galdr 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/galdr-x-3/raw/index.md(查看排版版本)