Appearance
Video-Use:一句话让Claude Code把素材剪成可发布视频
一个朋友的痛点:每周发一条vlog,录制一小时,剪辑要花三四个小时,最耗时间的是剪掉「呃」「嗯」。一条视频要手动打点几十次。Video-Use让这件事被自动化了。
Video-Use 是什么
Browser Use团队开源的Claude Code Skill,安装后一句话让AI自动剪辑视频:
把xxx文件夹里的视频素材剪辑成一条可发布的视频。自动完成:
| 步骤 | 说明 |
|---|---|
| 1 | 盘点素材 |
| 2 | 生成剪辑方案 |
| 3 | 识别并剪掉口头禅片段 |
| 4 | 每段素材做色彩调级 |
| 5 | 每个剪切点加30毫秒音频淡入淡出 |
| 6 | 加字幕 |
| 7 | 输出合并完成的视频 |
核心技术:两层处理架构
第一层:音频层(常驻加载)
| 技术 | 说明 |
|---|---|
| ElevenLabs Scribe | 转写带词级时间戳的文字稿 |
| 信息标注 | 说话人、笑声、叹息 |
词级时间戳是剪辑精度的命门——缺了它每一刀切在哪全靠瞎猜。
第二层:视觉层(按需调用)
| 场景 | 说明 |
|---|---|
| 模糊停顿 | 需要看帧确认 |
| 重录比对 | 需要看帧确认 |
| 剪辑点确认 | 需要看帧确认 |
不是全程喂帧,是在真正需要「看」的时候才看。
自检机制
渲染完成后的自动检查:
| 检查项 | 说明 |
|---|---|
| 画面跳切 | 自动检测 |
| 爆音 | 自动检测 |
| 字幕遮挡 | 自动检测 |
有问题自动回炉重新渲染,最多3次,通过才输出预览。
上下文记忆
每次剪辑的上下文写入project.md,同一项目的多次剪辑会继承之前的决策。
总结
| 要点 | 说明 |
|---|---|
| 核心价值 | 一句话自动剪辑 |
| 技术亮点 | 音频层常驻+视觉层按需 |
| 精度保障 | 词级时间戳 |
| 质量保障 | 自检机制+最多3次重试 |
一句话总结:Video-Use把「看视频帧」换成「读带时间戳的转录文本」,大幅降Token同时保精度,一句话搞定视频剪辑。
