开源项目 · Python · GPL-3.0 · 视频

在视频工作流中的位置
Auto-Editor 是 WyattBlue 团队 2022 年公开的开源 AI 视频剪辑工具,GitHub ★3.5k+,GPL-3.0 协议,主语言 Python(底层 FFmpeg)。通过分析音频波形 + 字幕密度,自动识别并剪除视频中的「静音段、卡顿、口头禅(um/uh/like 等)、重复句」,输出节奏紧凑的成品视频。命令行为主,提供 av(beta)GUI 桌面应用。适合 Vlogger / 播客 / 在线课程 / 直播录屏 / 会议录像的后期快速精剪。
核心能力围绕「音频驱动剪辑 + 模块化阈值」展开。音频分析:基于 librosa / 自研分析器提取音量曲线,标记静音段(默认阈值 -30dB,持续 ≥ 0.3s);剪切策略:可配置 --edit audio:threshold=0.05 / --edit motion:threshold=0.02 / --edit subtitle:style=哑音;口语习惯剪除:内置「filler word list」(English: um / uh / like / you know / I mean;Chinese 需自定义 regex);字幕驱动剪除:输入 SRT,自动剪除字幕间空隙;剪辑模式:audio(仅剪静音,安全)、motion(剪静态镜头,适合口播)、speech(剪口头禅)、subtitle(按字幕断句)。输出重新编码 MP4 / MKV / mov,保留原视频流编码或转 H.264/H.265。生态 FFmpeg / PyAV 后端;WASM 浏览器版(beta);GUI av 命令基于 Electron;Docker 镜像齐全。
适用场景:Vlogger/YouTuber 后期(去卡顿 + 静音)、播客视频版(去呃/嗯)、在线课程精剪、直播录屏压缩、会议录像精简、口播短视频二次精剪。硬件门槛:CPU 即可跑(分析阶段单核足够),GPU 非必需;长视频(1-2 小时)分析 5-10 分钟;输出编码阶段可走 GPU 加速(NVENC)。上手路径:pip install auto-editor → auto-editor input.mp4 --edit audio:threshold=0.05 -o output.mp4;GUI 用户 auto-editor --gui(或 av 命令)。
License 为 GPL-3.0,要求衍生作品开源(若分发)— 适合个人/内部工具使用,商业 SaaS 嵌入需谨慎(可走替代方案 ffmpeg 命令 + 自行实现逻辑)。Auto-Editor 与 VisLane 已收录的 descript(商用 AI 剪辑 + 文字驱动副驾)定位关系:Auto-Editor 是「命令行级开源内核」,descript 是「商用 SaaS 全功能」(文案驱动剪辑 + AI 副驾 Underlord + 转写 + 多机位);两者在「自动剪静音/卡顿」场景高度重叠 — Auto-Editor 免费且可嵌入自有流水线,descript 体验更佳但订阅 $24/月起。Auto-Editor 也可与 ShortGPT 互补 — ShortGPT 做内容生成,Auto-Editor 做后期精剪;但 Auto-Editor GPL-3.0 与 ShortGPT MIT 不冲突(MIT 不限制 GPL 依赖方向)。
在视频工作流中的位置
快速开始
部署教程与文档以外链形式呈现,未做内嵌以保证时效性。