ffmpeg-analyse-video-skill

利用FFmpeg与视觉AI分析视频,生成带时间戳的摘要。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:ffmpeg-analyse-video-skill。
它的用途是:利用FFmpeg与视觉AI分析视频,生成带时间戳的摘要。
完整的 Skill 内容见:https://321skill.com/skills/ffmpeg-analyse-video-skill/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“请分析这个屏幕录制视频,总结一下用户的操作步骤。” 它会先检查你的FFmpeg环境,然后自动提取视频关键帧,调用视觉模型理解每一帧的内容,最后生成一份带时间戳的、分步的操作摘要文档,告诉你视频里每个阶段发生了什么。

介绍

这个Skill解决了长视频内容分析时,大量图像数据会迅速耗尽AI上下文窗口,导致无法进行有效总结的难题。它通过一个创新的三层管道架构,将视频帧提取、图像内容识别与最终摘要合成解耦:主代理仅负责调用FFmpeg提取帧并管理流程,然后将图像批次分发给独立的子代理进行视觉分析,子代理完成任务后丢弃包含图像的上下文,仅将文本描述写回文件,主代理最后读取这些轻量级文本文件来合成带时间戳的结构化摘要。

使用时,用户只需提供一个视频文件,并触发如“分析这个视频”、“总结这个录像”等指令。Skill会根据视频时长自动选择最佳帧提取策略(如固定间隔、场景检测、关键帧提取),确保分析既高效又覆盖关键内容。

它非常适合需要快速理解视频视觉内容的用户,例如:教育工作者需要提炼教学录像的重点步骤;产品经理要分析用户操作录屏的流程;研究人员需从实验录像中提取关键事件;或任何需要为长视频(如教程、演示、监控录像)创建可搜索文字摘要的场景。

与同类直接上传所有帧到上下文的视频分析工具相比,它的核心优势在于通过“子代理管道”设计,将图像处理的巨大上下文开销隔离,使得主代理能保留充足的上下文用于高质量的摘要合成与用户后续对话,实现了效率与效果的平衡。

核心特点

采用“上下文高效子代理管道”架构,将耗资源的图像识别任务隔离在一次性上下文中,主代理只处理文本,使长视频分析成为可能,而不会爆掉上下文窗口。

注意事项

不适合分析纯音频文件或对视频中细微文字、快速动态变化有极高精度要求的场景。

常见问题

它能分析多长的视频?

理论上不限时长,但过长的视频会通过缩略图等策略采样分析。超过2GB的文件会建议分段分析。

需要本地安装FFmpeg吗?

是的,这是核心前提,Skill会引导用户在macOS、Linux或Windows上安装。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/ffmpeg-analyse-video-skill/raw/index.md 读取 ffmpeg-analyse-video-skill 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。