cut-video

基于MFA精准对齐,智能剪辑视频,去除冗余保留精华。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:cut-video。
它的用途是:基于MFA精准对齐,智能剪辑视频,去除冗余保留精华。
完整的 Skill 内容见:https://321skill.com/skills/cut-video/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“帮我剪辑这个视频,去掉所有‘嗯’、‘啊’和长时间的停顿。” 它会自动分析视频的音频轨道,识别出所有冗余的静默和填充词,并基于精确的词边界进行剪切,最终输出一个节奏明快、内容紧凑的新视频文件,你可以直接导入到CapCut等工具中进行进一步的美化。

介绍

cut-video 是一个专为处理长视频录音设计的AI技能,它能够智能识别并移除视频中的静默片段、填充词(如“嗯”、“啊”)、犹豫词、错误的开头和重复内容,同时巧妙地保留笑声和喜剧性的停顿。其核心目标是“收紧”视频节奏,产出更紧凑、更具吸引力的内容,适用于播客、访谈、教程等需要精简的场景。

使用方式非常直观:用户只需提供视频文件路径,并可选地指定剪辑风格(如“激进”、“平衡”等)。技能会首先创建视频代理文件以加速处理,然后利用Whisper生成字幕文本,再通过蒙特利尔强制对齐器(MFA)进行高精度的音频-文本对齐,从而确定精确到10-20毫秒的剪辑点,最后输出一个处理好的MP4文件。

这个技能非常适合内容创作者、视频编辑、播客制作者以及任何需要快速将冗长、未经剪辑的原始录像(如会议记录、直播回放、访谈素材)转化为精炼成品的用户。它尤其适合那些追求效率,希望自动化完成基础剪辑工作,以便将精力集中在创意和最终润色上的人。

与许多仅依赖Whisper时间戳进行粗略剪辑的工具不同,cut-video的核心优势在于其“双重校验”机制。它利用MFA进行精准的词边界对齐,解决了Whisper时间戳误差大、无法准确识别词间静默的问题,从而实现了更紧密、更自然的剪辑效果,避免了剪切单词开头或结尾的尴尬。

核心特点

本技能的核心区别在于其剪辑逻辑基于蒙特利尔强制对齐器(MFA)的词边界,而非原始的Whisper时间戳。MFA能提供10-20毫秒级别的对齐精度,并明确识别词与词之间的真实静默区间,从而实现了更精准、更自然的剪辑,有效避免了仅用Whisper时可能出现的词头词尾被误切或静默检测不准的问题。

注意事项

对于包含大量重复台词、即兴发挥或转录文本与口语严重不匹配的素材(如排练、多版本重录),MFA可能因对齐错误而产生时间漂移,导致后半段剪辑失效,需要人工介入校验。

常见问题

cut-video能保留视频中的笑声吗?

可以,技能专门设计为在激进剪辑的同时,保留笑声和喜剧性停顿,以维持视频的情感节奏和趣味性。

处理视频需要多长时间?

时间取决于视频长度和复杂度。技能会先创建代理文件加速处理,但MFA对齐和转录步骤仍需一定计算时间,通常比纯Whisper剪辑稍长,但结果更精确。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/cut-video/raw/index.md 读取 cut-video 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。