在 Windows 上安装 GeneFace++(一个基于深度学习的语音驱动人脸动画生成项目),主要需要注意环境依赖、编译工具、路径与版本兼容性等坑。下面给你一份实用注意事项清单。
一、基础环境准备
1. 系统要求
- Windows 10 / 11(64 位)
- 建议使用 有 NVIDIA 独显 的机器(CUDA 加速)
- 至少 16GB 内存,推荐 32GB
2. Python 版本(非常关键)
GeneFace++ 通常基于:
- ✅ Python 3.8 / 3.9
- ❌ 不建议 Python 3.10+(部分依赖不兼容)
建议用 conda 管理环境:
conda create -n geneface python=3.9
conda activate geneface
二、CUDA / PyTorch 注意事项
1. 显卡驱动 & CUDA
- 安装 NVIDIA 驱动(最新稳定版)
- CUDA 版本通常要求:
- CUDA 11.7 / 11.8
- 查看支持版本:
nvidia-smi
2. PyTorch 安装(Windows 常见坑)
不要用 pip 默认源乱装,推荐:
pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118
验证:
import torch
print(torch.cuda.is_available())
三、Windows 特有编译问题
1. 安装 Visual Studio(必须)
GeneFace++ 含 C++/CUDA 扩展,必须装:
- Visual Studio 2019 / 2022
- 勾选:
- ✅ “使用 C++ 的桌面开发”
- ✅ Windows 10 SDK
2. 安装 Build Tools
pip install wheel setuptools
四、依赖安装注意事项
1. 常见依赖
pip install -r requirements.txt
⚠️ Windows 上容易出问题的包:
face-alignmentlibrosanumbaopencv-python
建议顺序:
pip install numpy
pip install opencv-python
pip install librosa
五、路径 & 文件格式问题(Windows 重灾区)
1. 路径不要有中文 / 空格
❌ D:\我的项目\GeneFace++
✅ D:\projects\GeneFacePlusPlus
2. 路径分隔符
- 代码中可能写
/ - Windows 下一般没问题,但配置文件里要小心
六、模型 & 数据准备
1. 预训练模型
- 从官方仓库 / HuggingFace 下载
- 放到指定目录(看 README)
- 注意 文件是否下载完整
2. 音频格式
- 推荐:
wav - 采样率:16000 / 22050 Hz
七、运行时的常见坑
1. DLL 报错
通常是:
- VS 运行库缺失
- CUDA / PyTorch 版本不匹配
2. 显存不足
- 降低 batch size
- 使用
--cpu(慢但能跑)
3. ffmpeg
需要系统安装并加入 PATH:
ffmpeg -version
八、推荐使用方式(Windows 用户)
✅ 最稳方案:
- Windows + WSL2(Ubuntu)
- 或直接用 Linux 服务器
如果你只是体验,也可以:
九、快速检查清单 ✅
- [ ] Python 3.9
- [ ] CUDA 11.8
- [ ] VS2019/2022 已装
- [ ] 无中文路径
- [ ] ffmpeg 可用
- [ ] torch.cuda.is_available() = True
如果你愿意,可以告诉我:
- 你的 Windows 版本 + 显卡型号
- 是 安装失败 / 运行报错 / 推理效果问题
我可以直接帮你对症解决。