在 Windows 上安装 GeneFace++(一个基于 NeRF 的 talking head / 音频驱动人脸动画项目)时,有几个常见的坑和必须注意的点。下面按「环境 → 依赖 → 编译 → 数据 → 运行」给你梳理。
一、系统与硬件前提
1. 系统版本
- Windows 10 / 11 64 位
- 不建议用太老的 Win7(很多 CUDA / PyTorch 不支持)
2. 显卡 & CUDA
GeneFace++ 强依赖 GPU:
- NVIDIA 显卡(必需)
- 驱动较新(建议 ≥ 525)
- CUDA 版本要和 PyTorch 对应(常见 CUDA 11.7 / 11.8)
⚠️ 不支持 AMD / 核显训练
二、Python 环境(非常关键)
推荐配置
- Python 3.9 或 3.10
- 使用 conda(强烈建议)
conda create -n geneface python=3.9
conda activate geneface
不要混用 pip 和 conda 装 PyTorch
错误示例(会爆):
pip install torch # 默认 CPU 版
正确示例:
pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118
三、核心依赖与坑点
1. PyTorch3D(Windows 大坑)
GeneFace++ 依赖 PyTorch3D,Windows 下:
- ❌ 不能直接
pip install pytorch3d - ✅ 需要 源码编译
解决方式:
- 使用预编译 wheel(搜索:
pytorch3d windows cu118 wheel) - 或降低 PyTorch 版本匹配官方 wheel
2. ffmpeg(必须)
- 安装 ffmpeg 并加入 PATH
- 否则音频 / 视频处理直接报错
验证:
ffmpeg -version
3. 其他常见依赖
pip install numpy==1.23.5
pip install opencv-python
pip install librosa
pip install tqdm
⚠️ numpy 版本过高会导致 PyTorch3D 崩
四、代码与数据准备
1. 克隆仓库
git clone https://github.com/liangbinxh/GeneFacePlusPlus
cd GeneFacePlusPlus
2. 数据路径(最容易错)
GeneFace++ 对路径极其敏感:
D:\projects\GeneFacePlusPlus
五、训练 / 推理时的注意事项
1. 显存要求
- 训练:≥ 16GB 显存(24GB 更稳)
- 推理:≥ 8GB
2. 音频预处理
- 音频必须是 16k / 单声道
- 否则音频特征提取会失败
3. 配置文件
- 修改
configs/*.yaml - Windows 下路径用 双反斜杠或 /
六、Windows 特有坑总结
✅ 必须用 conda
✅ PyTorch3D 要预编译
✅ ffmpeg 必须配置
✅ 路径不能中文
✅ numpy 别太新
❌ 不要指望纯 CPU 跑
七、如果你只是“用模型不想训练”
可以直接:
- 下载作者提供的 pretrained model
- 只做 inference
- 显存要求大幅降低
如果你愿意,我可以:
- 给你一套 Windows 可用的完整安装命令
- 或帮你 对照报错信息排错
- 或说明 GeneFace++ vs GeneFace 区别
你现在是「训练」还是「只用模型」?