当然可以!下面我用新手友好的方式,一步一步讲:在 Windows 上部署 GeneFace++(一个声音驱动数字人/说话头生成项目)。
⚠️ 说明:GeneFace++ 官方主要面向 Linux,但 Windows 也可以跑,只是要避开一些坑。
GeneFace++ 是:输入音频 → 生成会说话、会动嘴的数字人视频
Add Python to PATH下载:
CUDA:
https://developer.nvidia.com/cuda-11-8-0-download-archive
cuDNN(需注册):
https://developer.nvidia.com/cudnn
不确定版本可以问我,我帮你查
bin 目录加到 系统环境变量 PATHgit clone https://github.com/tencent-ailab/GeneFacePlusPlus.git
cd GeneFacePlusPluspython -m venv venv
venv\Scripts\activate(venv) 就成功了pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118pip install -r requirements.txt如果报错:
GeneFace++ 需要预训练模型:
官方模型地址(README 里有):
一般放在:
checkpoints/python inference.py \
--audio examples/audio.wav \
--out output.mp4❌ RuntimeError: CUDA not available
✅ 检查 PyTorch 是否 GPU 版
❌ ffmpeg 找不到
✅ 重启终端 / 检查 PATH
❌ 路径有中文
✅ 全部用英文路径
❌ 显存爆炸
你可以直接问:
我可以一步一步陪你跑通 ✅