当前位置: 首页 > news >正文

Deep-Live-Cam 实时换脸工具:3 次点击换掉摄像头里的脸,免费开源完整教程

Deep-Live-Cam 实时换脸工具:3 次点击换掉摄像头里的脸,免费开源完整教程

【免费下载链接】Deep-Live-Camreal time face swap and one-click video deepfake with only a single image项目地址: https://gitcode.com/GitHub_Trending/de/Deep-Live-Cam

Deep-Live-Cam 是一款免费开源的实时 AI 换脸工具:选一张照片,指向摄像头或本地视频,画面里的人脸会被逐帧实时替换。不用写代码,装好之后 3 次点击就能开播。从空文件夹到换脸推流跑通,我把整条路线走了一遍,下面所有数字都能在项目里核实。

📦 第一站:3 条命令装好换脸工具

装完就能跑,全部操作就是克隆、建虚拟环境、装依赖这三步。官方 README 也明说手动安装有一定门槛,照表照抄别跳步。

环境自查:5 样东西

这张表解决"我的电脑缺什么"的问题,装之前对一遍。

项目要求备注
系统Windows / macOS / LinuxmacOS 面向 M1-M5 芯片
Python3.14 推荐3.11-3.14 均可
基础依赖pip、git、ffmpeg视频模式依赖 ffmpeg
Windows 额外Visual Studio 2022 运行库缺失会启动报错
macOS 额外Homebrew 装 python-tk图形界面依赖 tkinter

克隆、装依赖、启动

git clone --depth 1 https://gitcode.com/GitHub_Trending/de/Deep-Live-Cam cd Deep-Live-Cam
python -m venv venv # Windows 激活:venv\Scripts\activate # macOS / Linux 激活:source venv/bin/activate pip install -r requirements.txt
python run.py

首次运行会自动下载约 300MB 的换脸模型,所以第一遍启动比之后慢。换脸核心算法在 modules/processors/frame/face_swapper.py(检测、对齐、贴回全流程),人脸定位在 modules/face_analyser.py(人脸检测与特征提取),想改行为先去这两个文件找逻辑。

📺 第二站:3 次点击,摄像头变成换脸直播流

装好后主界面就是一个深色窗口,摄像头换脸只需 3 次点击,Live 预览窗口本身就是直播素材。

3 次点击的具体动作

  1. Select a face,选一张清晰正脸照片,光照均匀、无遮挡
  2. Select a target,选你的摄像头
  3. Live,等 10-30 秒预览窗口出现,换脸完成

要开播就把 Live 窗口拖进 OBS 做窗口捕获,直接推流。想换另一张脸,重新选源照片即可。

按硬件挑加速方式

同一个启动命令,加不加参数差别在帧率。不加参数默认 CPU 推理,能预览但慢;有独显或 Apple 芯片就走对应加速。

硬件启动命令需要预先安装
NVIDIA 显卡python run.py --execution-provider cudaCUDA Toolkit 12.8 + cuDNN 8.9.7,onnxruntime-gpu==1.21.0
Apple M1-M5python run.py --execution-provider coremlPython 3.14 与 python-tk,无需额外安装
AMD/Intel 核显(Win)python run.py --execution-provider directmlonnxruntime-directml==1.21.0
Intel CPUpython run.py --execution-provider openvinoonnxruntime-openvino==1.21.0,需配对对应 OpenVINO 版本
无独显python run.py无,CPU 推理

🎬 第三站:把一部视频换成你的脸

视频模式和摄像头模式共用同一张源照片,只是目标从摄像头换成视频文件,跑完输出到以目标视频命名的目录里。

选脸、选视频、Start

选好源脸后,点Select a target选本地视频,点Start。不想等整条视频跑完,可以先点Preview抽帧看效果,中途想停就点Destroy

输出质量与音轨

Keep audio 默认开启,原音轨保留;Keep fps 控制输出帧率是跟随原视频还是按你的处理速度。想要更细的控制走命令行:--video-quality取值 0-51,越小质量越高文件越大;--video-encoder可选 libx264、libx265、libvpx-vp9;--many-faces--map-faces--mouth-mask与界面上的开关一一对应。

🎛️ 第四站:3 个滑块,把换脸效果调自然

界面上真正改变观感的是滑块区和两组开关,其中影响最大的是 Mouth Mask——直播时最违和的就是嘴。

参数速查

这张表解决"哪个滑块管哪件事"的问题,都是界面里的实际取值。

参数范围默认值影响
Transparency 透明度0-100100换脸结果与原画面混合程度,调低弱化"贴纸感"
Sharpness 锐化0-50锐化增强后的面部输出
Mouth Mask 嘴部遮罩0-10000 用换后的嘴,100 保留原嘴直到下巴
Face Enhancer 面部增强None / GFPGAN / GPEN-512 / GPEN-256None重绘面部细节,每帧多一次推理,帧率下降

Mouth Mask:保留原口型

换掉的脸不会跟着你说话动,这是违和感的最大来源。把 Mouth Mask 拉到 30-100,程序会用换脸前的原始嘴部像素覆盖回去,口型和你说话完全一致。代价是嘴部区域不再属于"换后的脸",权衡看你对口型的要求。

Many Faces 与 Map Faces:多人场景

打开 Many Faces,画面里每张脸都会被换,而不只是最大的那张;再配合 Map Faces,可以给不同的人分配不同的源脸。所有滑块和开关的实现在 modules/ui.py(图形界面与控件定义),想改默认值从这里入手;增强模型放哪里看 models/instructions.txt(两个模型的下载地址)。

🛠️ 第五站:出问题时按这个顺序查

装完跑不通的问题高度集中在三类,按启动报错、性能、视频分别自查。

启动类:黑屏、缺模块、模型加载失败

症状:点 Live 没反应或预览全黑;报ModuleNotFoundError;提示找不到换脸模型。 原因:选错摄像头或系统相机权限没给;虚拟环境没激活;Python 版本不在 3.11-3.14 区间;首次模型下载被中断。 解决:重新点Select a target切换摄像头编号,macOS 到"系统设置 → 隐私与安全性 → 相机"给终端授权;先激活 venv 再执行pip install --upgrade -r requirements.txt;确认 models/ 目录里有两个模型文件,缺失就删掉残缺文件重跑让它重新下载。

性能类:帧率上不去、画面卡顿

症状:Live 模式帧率明显跟不上说话节奏。 原因:默认 CPU 推理,或开了 Face Enhancer,或目标分辨率过高。 解决:NVIDIA 用户改跑python run.py --execution-provider cuda;先关掉 Face Enhancer 再试;视频目标先降到 720p 验证。

视频类:提示找不到 ffmpeg

症状:Start 后报 ffmpeg 相关错误。 原因:系统没装 ffmpeg 或没加进 PATH。 解决:安装 ffmpeg,确认终端里ffmpeg -version能正常输出,再重启程序。

使用边界

程序内置内容过滤器,处理前会扫描素材,敏感内容会被直接拒绝,这不是可以绕过的开关。用真实人物的脸之前,先拿到本人同意;发布时标注 AI 生成,这是项目说明里写明的行为准则。

现在克隆仓库跑起来,选一张正脸照片,亲自试试这 3 次点击。

【免费下载链接】Deep-Live-Camreal time face swap and one-click video deepfake with only a single image项目地址: https://gitcode.com/GitHub_Trending/de/Deep-Live-Cam

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

http://www.cnnetsun.cn/news/4284898.html

相关文章:

  • 猿辅导2023校招技术岗笔试(二)全解析:题型、算法与备考策略
  • 专利撰写Skill:用AI Agent将论文idea自动转化为专利交底书
  • DeepSeek 7B 微调把 RTX 4060 撑爆,我在深度学习入门里翻出这 4 个显存优化才跑通
  • DriveTeach-VLA:图像轨迹如何破解自动驾驶预训练难题
  • 设计模式实战:用观察者、策略、命令模式构建可扩展JavaScript计数器
  • 免费aigc检测查重能用于学校提交吗?AI降重结果不能代替正式报告
  • 实时视频问诊中的医疗AI:多模态引擎与工程落地
  • Netdata Windows 监控指南:三步把 Windows 服务器接入实时监控
  • Netdata Windows监控怎么装?5分钟跑通第一张监控图
  • AI写论文哪个软件最好?毕夏AI用“全链路思维”给了一个不一样的答案
  • MinerU 版本升级指南:从 1.x 到 2.7 的完整迁移路径
  • 垂直AI落地陷阱:为什么说大模型在“掷骰子”,以及如何工程化应对
  • C#文件操作全解析:从基础API到高级性能优化实战
  • 瑞萨RZ/G3E 64位MPU:高性能HMI与边缘AI加速的设计解析
  • 层次分析法实战:从原理到Excel/Python实现,解决复杂决策难题
  • 嵌入式多点触控实战:从硬件选型到UI手势系统落地
  • 粒子群算法原理与实战:从优化概念到数学建模应用
  • MATLAB三维绘图从入门到精通:mesh、surf、plot3核心函数详解
  • 网易人机交互算法实习生笔试复盘与备考指南
  • 时间序列分析:AR、MA与ARMA模型原理与实战建模指南
  • RTK卸载指南:3步彻底移除Hook、RTK.md和二进制,不留后患
  • 电竞数据分析实战指南:用公开数据集搭出完整分析链路
  • 触宝科技校招研发笔试题全解析:算法、数据结构与系统设计实战
  • LocalSend 完整使用指南:无网络环境下跨设备传文件的简单教程
  • MySQL核心机制深度解析:B+树索引、事务隔离与SQL优化实战
  • 滴滴算法岗笔试全解析:考点拆解、实战复盘与避坑指南
  • Fira Code 连字编程字体完全指南:从安装、配置到自定义的完整流程
  • Netdata Windows监控实战指南:从单机部署到跨平台统一监控的全解析
  • C++模板编程:从泛型基础到现代概念与工程实践
  • PaddleOCR Android部署实战:3步跑通移动端OCR文字识别应用