
SadTalker 10 分钟跑通语音驱动人脸动画新手指南【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalkerSadTalker 是一个语音驱动人脸动画项目给它一张人脸图片和一段音频就能生成口型同步、带动自然头部运动的说话视频。这篇指南覆盖克隆仓库、环境配置、模型下载和第一次运行并附上新手最容易撞上的报错及修复命令跟着做即可完成从安装到出片的全流程。环境体检Python 3.8、Conda 与 FFmpeg这一节列出全部依赖并给出一键校验命令三条命令都能输出版本号说明你的环境已就绪。先确认这四项依赖依赖用途建议版本Python运行环境3.8兼容性最佳Conda环境隔离Anaconda 或 Miniconda 均可Git克隆仓库任意新版FFmpeg视频处理任意新版必装执行以下三条命令体检python --version git --version ffmpeg -version⚠️ FFmpeg 是最容易被漏装的一项后文「ffmpeg 未找到」类报错基本都源于此。一键安装步骤克隆、建环境、下模型这一节把克隆代码、创建隔离环境、下载模型三个动作按顺序走完执行完就得到一个可直接运行的项目目录。三个平台通用命令git clone https://gitcode.com/GitHub_Trending/sa/SadTalker cd SadTalker conda create -n sadtalker python3.8 conda activate sadtalker pip install torch torchvision torchaudio pip install -r requirements.txt bash scripts/download_models.sh最后一条命令会自动创建checkpoints/和gfpgan/weights/目录并下载音频转表情、音频转姿态、256/512 两档人脸渲染模型及人脸增强模型总共约 2GB请保持网络稳定。Windows 差异FFmpeg 需单独安装并加入 PATHscoop install ffmpegmacOS 差异M1/M2 适用brew install ffmpeg pip install dlibmacOS 必须单独安装原版 dlib否则运行时会报 Illegal Hardware Error。Linux 差异conda install ffmpeg第一次运行生成说话人脸视频这一节执行最小可运行命令几分钟后会得到一个可直接播放的 mp4 文件。直接使用仓库自带的示例素材一张全身人像 一段中文新闻音频python inference.py --driven_audio examples/driven_audio/chinese_news.wav --source_image examples/source_image/full_body_1.png --result_dir results输入图片换成单人正脸照效果更好例如成功运行后结果保存在results/目录下文件名为时间戳例如results/2026_09_11_10.05.00.mp4。用任意播放器打开即可看到生成的人脸动画。报错急救包六类高频错误速查每条按「报错 → 原因 → 修复命令」三段式给出遇到哪个直接查哪条。ffmpeg 未找到命令原因FFmpeg 未安装或未加入系统 PATH。修复命令Windows 执行scoop install ffmpegmacOS 执行brew install ffmpegLinux 执行conda install ffmpeg装完用ffmpeg -version验证。ModuleNotFoundError: No module named ai原因模型文件未下载完整或已损坏。修复命令bash scripts/download_models.sh脚本支持断点续传重跑只补下缺失的模型文件。Illegal Hardware ErrorMac M1/M2原因dlib 未按当前芯片架构安装。修复命令pip install dlibFileNotFoundError: checkpoints/BFM_Fitting/similarity_Lm3D_all.mat原因模型文件未下载或没有放到正确目录。修复命令重跑bash scripts/download_models.sh并确认checkpoints/与gfpgan/weights/目录下都有模型文件。RuntimeError: unexpected EOF, file might be corrupted原因下载中途网络中断文件不完整。修复命令删除损坏文件后重跑bash scripts/download_models.sh重新获取。CUDA out of memory原因显存不足或显存碎片化低显存显卡常见。修复命令set PYTORCH_CUDA_ALLOC_CONFmax_split_size_mb:128Linux/macOS 将set换成export设置后再重新运行推理命令。Error while decoding stream #0:0原因输入音频格式不受支持本项目只接受 wav 或 mp3。修复命令把音频先转成 wav 或 mp3 再传入--driven_audio。进阶玩法两个参数提升视频质量跑通后调整两个参数效果就能再上一个台阶。调表情强度--expression_scale控制面部表情幅度默认 1.0觉得表情僵硬可以调大python inference.py --driven_audio examples/driven_audio/chinese_poem1.wav --source_image examples/source_image/art_5.png --expression_scale 2.0 --result_dir results全身图 人脸增强全身照输入时加--still --preprocess full保持原始头部姿态并贴回原图再加--enhancer gfpgan提升人脸清晰度出片更自然。下一步建议替换examples/source_image/与examples/driven_audio/里的其他素材对比不同图片与音色的效果差异参数全表见 最佳实践文档可进一步探索参考视频姿态、自由视角等能力遇到更深层的问题先查 官方FAQ 与 安装文档再考虑到仓库提交 issue。【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalker创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考