SadTalker 说话头视频生成入门指南一张照片配一段音频做出说话视频【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalkerSadTalker 是一款音频驱动的说话头视频生成开源工具输入一张人像照片和一段音频输出人物开口说话、头部带自然运动的视频。全程本地离线运行适合内容创作者、教育者和没有编程背景的新手。项目定位三个值得知道的点SadTalker 是 CVPR 2023 论文项目由西安交通大学与腾讯 AI Lab 联合发布采用 Apache 2.0 许可可免费商用。核心流程就是单张肖像 音频 说话头视频。用音频驱动 3D 运动系数口型、头姿、表情由音频推算运动比直接生成更稳定支持 512x512 分辨率面部渲染可叠加 gfpgan / RestoreFormer 修复面部细节提供 crop / resize / full 三种预处理模式还能从参考视频借用眨眼与头姿 3 步跑起本地 WebUI环境准备一句话带过装好 Python 3.8、git、ffmpeg 即可。获取代码git clone https://gitcode.com/GitHub_Trending/sa/SadTalker下载模型。Linux/Mac 在仓库目录执行bash scripts/download_models.sh一键完成Windows 用户可改从 Releases 页面手动下载后放到对应目录。启动 WebUIWindows双击webui.bat依赖会自动安装完成后浏览器直接打开Linux/Mac执行bash webui.sh在页面里上传图片和音频、选择模式、点生成即可。习惯命令行的话一条命令就够python inference.py --driven_audio audio.wav --source_image portrait.png --enhancer gfpgan结果保存在results/下带时间戳的文件夹里。⚙️ 速查影响效果的几个参数参数默认值作用--preprocesscropcrop只生成面部区域最稳定resize整图缩放适合证件照式图片full整图动画需配合--still--still关保持原图头部姿态减少头部运动全身图模式建议开启--expression_scale1.0数值越大表情越夸张--enhancer无填gfpgan或RestoreFormer修复面部细节--ref_eyeblink无指定参考视频借用其中的眨眼动作--result_dir./results输出目录️ 让效果更好的两处选择选图优先正面、光线均匀、分辨率高的人像证件照式图片用 resize 模式官方提供的示例人像长这样目前只支持真人或写实风格人像动漫脸暂不支持官方文档中有说明选音频与参考视频音频只支持 wav / mp3底噪越小口型越准默认生成的眨眼和头部动作偏少可用--ref_eyeblink指定一段视频借动作效果对比如下适合谁用教育工作者把静态讲师照片变成课程讲解视频或做语言发音演示内容创作者数字人口播、动漫角色配音视频开发者完全离线本地推理也可通过 Stable Diffusion WebUI 扩展接入现有工作流排查清单遇到问题按序检查提示ffmpeg不是内部命令安装 ffmpeg 并加入 PATH找不到模型文件如 BFM、.mat缺失重新执行模型下载脚本确认下载完整ModuleNotFoundError: No module named aiepoch_20.pth模型损坏重新下载Mac M1 报 Illegal Hardware单独执行pip install dlib重装CUDA 显存不足运行前设置环境变量PYTORCH_CUDA_ALLOC_CONFmax_split_size_mb:128音频解码报错输入音频不是 wav / mp3先转换格式完整问答见 docs/FAQ.md。查阅更多文档各模式的官方推荐配置、--ref_pose头姿借用等进阶用法见最佳实践与配置指南3D 面部渲染与自由视角生成在 docs/face3d.md 中有专门说明。【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalker创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考