开源免费版的剪映,还带本地 AI 字幕
视频基本功能
有一个开源软件叫 Concat,能剪片子,能自动加字幕,能配音,能抠图,全程不收钱、不加水印、不用登录账号。
它原来叫 WolfCut,作者是一位网名 jub0t 的开发者。项目从建立到现在还不到一个月,但已经积累了不少关注。

多轨道编辑,视频、音频、字幕、图片各走各的轨。一个项目里还能放多条时间线,方便你把不同的段落分开剪,最后再合起来。
剪辑的基础操作齐全,分割、修剪、合并、拖拽排序都在。转场、变速、冻结帧也有。
标题和样式文字能做,字体、颜色都可以调。模板功能可以把一次做好的排版存下来重复用。
内置特效大约九十个,还有关键帧动画。语音滤镜可以给声音做修理,也能做出各种变化效果。
唯一没有的是任何 Vip 功能,全都可以直接使用。
本地跑的 AI 模型
主要的模型功能
自动字幕
whisper 模型
·
文字转语音
Kokoro 模型
·
抠图
ONNX 推理
三个模型都在你的电脑上跑,不经过服务器
自动字幕用的是 whisper 模型,在本机跑,模型大小从 78MB 到 488MB 可以自己选。想要快就选小的,想要准就选大的。
文字转语音也是本地的,用的是一个叫 Kokoro 的语音模型,有 132MB 和 349MB 两种规格。
抠图分人像和物体两种,人像模型 15MB,物体模型 179MB,靠的是一种叫 ONNX 的推理框架。它不需要绿幕,直接就能把人从背景里分出来,还带一个智能笔刷,可以手动修补边缘。

导出是无水印的 MP4,整个过程不出本机。
这四个模型都是第一次使用时下载,之后就不再需要联网。日志只保留最近十次运行,也不会自动上传。
技术框架
Concat 的引擎是用 Rust 写的,界面用的是一套叫 Slint 的框架。这两样都是近几年在开源圈子里比较受关注的技术,好处是程序体积小、启动快、在 Windows 和 macOS 上都能原生运行。
视频的编解码交给 FFmpeg,这是目前开源视频工具里最通用的底层库,绝大多数你听过的剪辑软件都在用它。画面合成可以用显卡加速,走的是 wgpu,支持 Metal、DirectX 12 和 Vulkan 三套图形接口,你的电脑是哪一种它就用哪一种。
一个设计上的细节
它的时间线不使用小数点来计算时间,而是用精确的分数。原因是浮点数会有累积误差,短视频几秒钟看不出来,但一个几万帧的项目跑下来,画面和声音就会慢慢对不上。
作者还留了一个扩展接口,将来第三方可以自己写插件接进来。
装之前要知道几件事
支持平台比多数开源剪辑软件广。Windows、macOS、Linux 都有安装包,安卓手机和平板也支持,iOS 和 iPadOS 标注的是待测试。
macOS 有个坑,安装包没有签名,装完如果系统提示无法验证,需要跑下面这句命令。
bash
xattr -dr com.apple.quarantine /Applications/Concat.app
安卓需要 8.0 以上并且是 64 位。iOS 需要 15 以上,而且得用 AltStore、Sideloadly 或者 Xcode 侧载。
配置要求不高。最低是 2013 年以后的任意 64 位处理器、4GB 内存,没有独显也能跑。官方建议的是六核以上加 16GB 内存。硬盘上应用本体加最小字幕模型占 500MB,全部可选模型加起来大概 2GB。
目前它是 0.2 版 Beta,项目出生还不到一个月。 导出只有 H.264 MP4 一种格式,没有 WebM、ProRes 和 HEVC。拿它跟达芬奇比专业功能,还不在一个层次上。
许可证方面,它用的是 AGPL-3.0,这是一种要求修改后的代码也必须开源的协议。作者刚开始用的是另一种更宽松的 MPL-2.0,后来专门换掉了,理由是这样别人没法把整个引擎拿走做成闭源产品。
剪短视频、加字幕、配音、抠图,它现在都能干
而且免费、无水印、素材不出本机。要专业出片还得再等等。
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
