以前剪视频大概是这样:导入素材 → 看时间轴 → 找废话 → 删除停顿 → 调整音频 → 加字幕 → 调颜色 → 加动画 → 导出。一个几分钟的视频,可能就要折腾几个小时。

但现在,AI 开始进入视频剪辑。GitHub 最近有一个叫video-use的项目很有意思,它直接把Claude Code变成了视频剪辑 Agent。使用方式非常简单:你只需要把原始视频放进一个文件夹,然后告诉 AI"帮我剪这个视频",最后 AI 分析视频 → 生成剪辑方案 → 自动剪辑 → 检查结果 → 输出 final.mp4。没错,最后直接得到final.mp4。

而且项目强调:不需要预设、不需要复杂菜单、直接和 AI Agent 聊天。目前项目已经获得超过2 万 GitHub Star。

打开网易新闻 查看精彩图片

视频剪辑,开始变成 AI Agent 的任务

现在 AI Coding 已经很成熟,你可以让 Claude Code 创建项目、修改代码、修复 Bug、运行测试、部署服务。而 video-use 做的事情,就是把这套模式搬到了视频剪辑。以前是你操作剪辑软件,现在是你告诉 AI 想剪成什么样,AI 操作工具,输出视频。

打开网易新闻 查看精彩图片

打开网易新闻 查看精彩图片

它支持的内容类型也比较广,比如口播视频、教程、旅行视频、采访、Montage。也就是说它不是只针对某一种短视频模板,而是先分析你的素材,再决定怎么剪。

"嗯……啊……"这些废话,AI 自动帮你删

很多人录视频都会出现"嗯……""啊……""这个……"以及说错了重新说、长时间停顿这些东西。以前基本需要人工找、人工剪。video-use 可以自动处理Filler Words(umm、uh、false starts),同时处理Dead Space(两段讲话之间没有意义的停顿)。

于是原始视频"你好……今天我们……嗯……来聊一个项目……"经过处理以后变成"你好,今天我们来聊一个项目。"整个视频更紧凑。

打开网易新闻 查看精彩图片

AI 剪视频,不是疯狂看 3 万帧

这里有一个非常有意思的设计。视频对 AI 来说其实是一个很麻烦的数据,比如 10 分钟视频如果每秒 30 帧,那么就是 18000 张图片。如果直接把这些图片全部交给 AI,不仅慢,而且Token 直接爆炸。

video-use 没有这么干,它采用的是Text + On-demand Visuals。简单理解:视频 → 转录 → 整理成文本 → AI 先阅读文本 → 需要时再查看关键画面。也就是说AI 不需要一直盯着视频,大部分时间看文本,只有需要判断"暂停位置?""两个镜头哪个好?""这里切会不会跳?"的时候才查看对应画面。

这个思路其实和现在 AI Agent 操作网页非常像,不是把整个屏幕不断截图给 AI,而是把结构化信息先交给 AI。

AI 先制定剪辑方案,再开始动手

这个项目有一点我觉得非常重要。它不是发现视频 → 直接乱剪,而是Ask → Confirm → Execute,也就是询问 → 确认策略 → 开始执行。

比如你给 AI 一堆素材,AI 不会直接咔咔咔全部剪掉,而是先判断视频类型是什么、目标是什么、应该剪成教程还是短视频、节奏应该快还是慢。确认策略以后,才开始真正剪辑。这比"AI 一上来就自动修改所有素材"要安全得多。

打开网易新闻 查看精彩图片

每一个剪辑点,AI 还会自己检查

这个功能很有意思。普通 AI 自动化是生成 → 完成,结束。video-use 多了一步Self-Eval,整个流程大概是:Transcribe → Pack → LLM Reasoning → EDL → Render → Self-Eval。

如果 AI 发现画面跳跃、切换不自然、音频出现爆音,它会重新检查 → 重新修改 → 再次渲染。而且有最大重试次数限制,不是无限循环修改,而是发现问题 → 修复 → 重新渲染,达到限制后停止。

这个思路其实很像现在AI Coding Agent:写代码 → 运行测试 → 发现错误 → 修改 → 重新测试。只不过这次测试的是视频。

打开网易新闻 查看精彩图片

字幕,也可以直接交给 AI

现在短视频里字幕已经非常重要。video-use 支持Burn Subtitles,也就是直接把字幕烧录进视频。默认可以采用两词一组,类似"AI STARTS"、"EDITING VIDEO"这种节奏。当然字幕样式也可以自定义,你可以告诉 AI 字体、位置、字幕节奏、显示方式。以前是在剪辑软件里打开字幕菜单设置样式,现在告诉 AI 就行。

动画,不是一个 AI 全部生成

项目还支持 HyperFrames、Remotion、Manim、PIL 来生成动画和视觉元素。更有意思的是可以使用多个 Sub-Agent。比如视频需要动画 A、动画 B、动画 C,系统可以让 Agent A 生成动画 A,Agent B 生成动画 B,Agent C 生成动画 C,最后并行完成。

这就意味着未来 AI 剪视频,可能不再是一个 AI 剪完整个视频,而是一个 AI 负责剪辑、一个 AI 负责字幕、一个 AI 负责动画、一个 AI 负责检查,真正形成AI 视频制作团队。

下周继续剪,AI 还能记住项目

视频项目通常不是一次完成,今天剪到一半,明天继续修改。以前你需要重新解释项目,video-use 会把Session Memory保存下来。项目使用 project.md 记录项目状态,所以今天开始剪,下周继续打开,AI 可以继续从上次的上下文开始。对于长视频项目,这个功能其实很实用。

如何使用?

项目目前支持通过 Claude Code、Codex、Hermes、OpenClaw 等具有 Shell 权限的 Agent 使用。官方给出的思路非常直接:首先让 AI Agent 读取安装文档,然后安装项目、配置 ffmpeg、注册 Skill。之后你只需要把视频放进文件夹,然后告诉 AI 开始剪,最终输出final.mp4。

# 1. Clone and symlink into your agent's skills directorygit clone https://github.com/browser-use/video-use ~/Developer/video-useln -sfn ~/Developer/video-use ~/.claude/skills/video-use        # Claude Code# ln -sfn ~/Developer/video-use ~/.codex/skills/video-use       # Codex# 2. Install depscd ~/Developer/video-useuv sync                         # or: pip install -e .brew install ffmpeg             # requiredbrew install yt-dlp             # optional, for downloading online sources# 3. Add your ElevenLabs API keycp .env.example .env$EDITOR .env                    # ELEVENLABS_API_KEY=...

过去,AI 视频工具大多是"点一下"生成一个模板视频。而 video-use 想做的事情,更像是给你找了一个 AI 剪辑师。你负责提供素材,AI 负责分析内容、制定策略、删除废话、处理停顿、调整颜色、生成字幕、添加动画,最后检查结果。

一句话总结:以前让 AI 帮你写代码,现在开始让 AI 帮你剪视频。

如果你平时做公众号视频、做 YouTube、做教程、做技术内容、做口播视频、做 AI 视频项目,这个 GitHub 项目确实值得收藏。

开源地址: https://github.com/browser-use/video-use

你平时剪视频是用剪映、Premiere 还是达芬奇?如果以后可以直接跟 AI 说"帮我剪这个视频"就能拿到成品,你觉得传统剪辑软件会被取代吗?