Windows跑GeneFace++怎么弄

AI技术
小华
2026-09-06

Windows 上跑 GeneFace++(一个基于深度学习的语音驱动人脸动画生成项目),虽然官方更推荐 Linux,但 Windows 也是可以跑的,只是坑会多一点。下面给你一个可落地的完整流程

一、GeneFace++ 是什么(先确认)

GeneFace++ 是 GeneFace 的升级版,用于:

  • 输入:音频 + 参考视频/图片
  • 输出:说话人脸视频

核心依赖:

  • Python
  • PyTorch
  • CUDA(强烈建议)
  • ffmpeg
  • 一些音频 / 视觉库

二、Windows 环境准备

1️⃣ 安装基础软件

  1. Python 3.9(推荐)
  1. Git
  1. FFmpeg
  1. Visual Studio Build Tools
  • 安装 “C++ 生成工具”
  • 否则很多包编译会失败

2️⃣ 安装 CUDA(关键)

GeneFace++ 需要 GPU

  • 查看显卡支持的 CUDA 版本(NVIDIA 控制面板)
  • 推荐:
  • CUDA 11.8
  • cuDNN 8.x

安装后确认:

nvidia-smi
nvcc --version

三、克隆 GeneFace++ 项目

git clone https://github.com/liumin time/GeneFacePlusPlus.git
cd GeneFacePlusPlus

(注意:GitHub 上可能有多个 fork,确保是 GeneFace++ 官方或高 star 版本)

四、创建 Python 虚拟环境(强烈建议)

python -m venv geneface
geneface\Scripts\activate

五、安装依赖(重点)

1️⃣ 安装 PyTorch(CUDA 版本)

pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118

2️⃣ 安装项目依赖

pip install -r requirements.txt

⚠️ Windows 常见问题:

  • pyworld 安装失败 → 用预编译 wheel
  • numba 版本不匹配 → 固定版本
  • face_alignment 可能要降级

六、准备模型和数据

1️⃣ 下载预训练模型

官方 README 会提供:

  • audio2motion 模型
  • motion2video 模型

放到:

checkpoints/

2️⃣ 准备数据

  • 参考视频(说话清晰)
  • 音频文件(wav)

七、运行推理(示例)

python inference.py \
--audio_path test.wav \
--video_path ref.mp4 \
--out_path output.mp4

具体参数以你下载版本 README 为准。

八、Windows 常见坑(必看)

问题 1:路径反斜杠

  • 用双反斜杠或 /

问题 2:多线程报错

  • 设置:
set OMP_NUM_THREADS=1

问题 3:显存爆炸

  • 减小 batch size
  • 使用半精度

问题 4:ffmpeg 找不到

  • 确认 ffmpeg -version 能运行

九、如果你不想折腾(推荐方案)

用 WSL2(Windows Subsystem for Linux)

  • 几乎等于 Ubuntu
  • 官方教程最匹配
  • 性能损失很小
wsl --install

然后在 Ubuntu 里按 Linux 教程跑。

十、我可以继续帮你

你可以告诉我:

  1. 你是 新手 / 有 Python 基础
  2. 显卡型号(如 3060 / 4070)
  3. 是想 自己训练 还是 只跑推理
  4. 卡在哪一步(报错直接贴)

我可以直接帮你 一步一步排错

亿速云提供售前/售后服务

售前业务咨询

售后技术保障

400-100-2938

7*24小时售后电话

官方微信小程序