当前位置: 首页 > news >正文

告别拖时间轴:用文本勾选轻松剪视频

告别拖时间轴:用文本勾选轻松剪视频

【免费下载链接】autocut用文本编辑器剪视频项目地址: https://gitcode.com/GitHub_Trending/au/autocut

上次帮朋友剪一期 40 分钟的播客,我在时间轴上拖了半个多小时,最后只留下 9 分钟。后来换个思路:剪辑本质上是选句子,何必盯着画面找入点?AutoCut 就是按这个思路剪视频的:先用 Whisper 自动生成带时间戳的字幕,你在 Markdown 里勾选想保留的句子,它自动剪出对应片段,全程不用打开剪辑软件。

它到底在做什么:字幕就是剪辑点

原理就一句话:把"看画面找入点出点"变成"读文字打勾"。AutoCut 先用 Whisper 把视频语音转成带时间戳的字幕,每句字幕对应视频里的一段;你像编辑文档一样只留下想说的句子,保存后它按勾选的句子把片段拼成新视频。打个比方,剪辑软件是拿剪刀在胶片上找位置,AutoCut 是拿红笔在文稿上圈要保留的段落,剩下的交给机器。

环境准备与首次运行:三行装好,两行跑通

依赖只有两个:Python 3.9+ 和 ffmpeg(apt、brew 里都是一条命令的事),GPU 版本还需要装好对应版本的 PyTorch。

打开终端,敲这几行:

git clone https://gitcode.com/GitHub_Trending/au/autocut cd autocut pip install .

最小可运行示例就两条命令:

autocut -t 22-52-00.mp4 # 生成 22-52-00.srt 和 .md autocut -c 22-52-00.mp4 22-52-00.srt 22-52-00.md # 输出 22-52-00_cut.mp4

第一次跑-t会下载 Whisper 模型,稍等即可。完成后视频旁边多出一对同名文件:.srt是标准字幕,.md是带复选框的勾选版;-c之后就会得到_cut.mp4

常用命令速览:一条命令干一件事

命令说明
autocut -t xxx.mp4转录视频,生成同名 .srt 和 .md
autocut -c xxx.mp4 xxx.srt xxx.md按勾选剪出 xxx_cut.mp4
autocut -c xxx.mp4 xxx.srt不习惯 Markdown?直接删 srt 里的行
autocut -m xxx.srt xxx.mp4已有字幕时补生成 .md 方便勾选
autocut -d ./videos常驻监控文件夹,新视频自动转录再剪

另外-s xxx.srt能生成紧凑版字幕(_compact.srt),空行少,方便在编辑器里二次精修。

进阶玩法与调优:用到哪一项再开哪一项

默认参数(small 模型、--bitrate 10m)已经能跑通全流程,下面这些按需打开即可:

参数什么时候用
--whisper-model large默认 small 准确率不够,且有 GPU
--lang en视频是英文或其他语种(默认 zh)
--bitrate 20m对输出质量要求更高
--device cpu显存不够,强制回退 CPU
--whisper-mode=openai本地算力有限,改调 API(需配置密钥)
--prompt "术语"出现大量专有名词,纠正识别

如果视频环境音比较杂,可以把--vad设为1开启语音活动检测,转录会更稳。

真实场景拆解:从 2 小时录屏到 8 分钟精华

课程录屏抽精华。2 小时的讲座录屏,中间穿插了大量口误和闲聊。第一步autocut -t lecture.mp4生成 md,边听边勾;第二步autocut -c输出。2 小时压到 10 分钟出头,口误基本清空。

OBS 每日录屏批量过。一天录好几条,OBS 里把文件名格式设成%CCYY-%MM-%DD/%hh-%mm-%ss,录像自动落到日期文件夹。然后autocut -d ./2026-08挂着监控,录完自动出 md,勾完自动出_cut.mp4;全部处理完在autocut.md里勾选要拼接的条目,还能导出合并版autocut_merged.mp4。几十条录屏不用逐条敲命令。

粗剪之后再精修一遍。第一遍勾得赶,剪出来的片子还残留几段废话。对剪好的文件再跑一次-t,句子变短、上下文更干净,细勾后再剪一次,废话基本就清干净了。

避坑速查:遇到报错先查这里

  • 输出 md 是乱码?默认用 utf-8,多半是编辑器编码不一致。Windows 上习惯 gbk 的话,生成和剪辑必须用同一套:autocut -t xxx.mp4 --encoding=gbk,剪辑时同样带上--encoding=gbk
  • GPU 报显存不够?large 模型吃显存,看到报错别慌,降一档换 small,或者--device cpu强制回退。
  • 转录慢得像蜗牛?先用--whisper-model tiny快速过一遍确认流程,再换大模型精转;有 NVIDIA 卡的话确认torch.cuda.is_available()为 True。
  • 剪了两次输出没更新?文件已存在时不会覆盖,加--force强制写入。

项目结构 & 社区

autocut/ ├── main.py # 命令行入口与参数解析 ├── transcribe.py # 转录,生成 srt / md ├── cut.py # 剪辑与拼接 ├── daemon.py # 文件夹监控 └── utils.py # 通用工具函数

各模块分工清晰,想扩展功能基本都在 autocut/ 目录里动手。遇到问题直接在 issue 区提;想提交代码,先跑一遍pytest testblack再发 PR。

AutoCut 把视频剪辑变成了一道勾选题:机器负责认字和切段,你只负责判断哪一句值得留。挑一个手头的视频跑一遍试试,第一次转录要下模型稍慢,之后的流程就是打开 md、打勾、等输出。

【免费下载链接】autocut用文本编辑器剪视频项目地址: https://gitcode.com/GitHub_Trending/au/autocut

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

http://www.cnnetsun.cn/news/4183254.html

相关文章:

  • 如何看懂 chess 多人国际象棋的走棋音效系统:完整机制详解
  • Java面试实战:大厂技术考察点与高分回答解析
  • AI绘画精准构图:俯视图提示词解决多人站位与场景一致性问题
  • Android相机YUV转RGB性能优化:从C2D瓶颈到零拷贝实战
  • ContractScrub基准实践:构建与评估法律合同审查AI模型
  • Waydroid 折腾记录(安卓兼容环境)
  • 无奖励函数智能体进化:基于成对验证器的AI训练新范式
  • Swift-Image:紧凑统一图像生成模型实战与性能优化指南
  • RR 定制镜像:8GB 镜像搞定 DSM 引导与恢复
  • 6GB显存玩转4K AI视频:ComfyUI节点化工作流与显存优化实战
  • Music Flamingo 实操拆解:80 亿参数 AI 音乐分析模型,10 分钟整曲听一遍
  • AI图像修复与分割:本地化部署与批量皮肤纹理处理方案
  • SWF 文件打不开了?Ruffle 桌面版两种快速播放方式一次讲清
  • 大模型开发实战:从AI Agent、RAG到微调与部署的完整指南
  • LTX-2.5:8G显存本地部署多模态AIGC视觉工具全解析
  • OpenSCAD 3D建模库 BOSL2 上手教程:30 分钟从安装到第一个模型
  • 基于Spring Boot的膳食搭配营养学知识智能问答小程序的实现
  • 机器学习实战指南:从数据到模型的全流程解析与避坑
  • 基于SpringBoot的合同信息管理系统(毕设源码+文档)
  • 美国大学生数学建模竞赛SP奖获奖指南:从创新建模到论文写作
  • 贴片热敏元件选型,成立年限为何不是唯一门槛
  • 2026 GEO案例实践:企业助力品牌成为AI推荐答案的完整路径
  • PyTorch插值操作详解:从torch.interpolate参数到CV实战应用
  • MCP Toolbox 配置速成:10 分钟跑通 tools.yaml,让 AI 连上第一个 MySQL
  • DeepSeek Flash 0731开源大模型本地部署与推理性能实战指南
  • Pisper Agent:热拔插插件与可视化工作流驱动的AI智能体开发框架实战
  • 如何为 qwerty-learner 快速选定存储方案:SQLite vs IndexedDB 完整对比指南
  • RTX Remix 完整教程:5 步把 DirectX 9 老游戏改成光线追踪大作
  • Git Worktrees完整上手:3步建好隔离工作空间,并行开发少踩3个坑
  • Windows本地部署SadTalker:从零搭建AI数字人生成器