
SadTalker1张照片生成说话视频3步跑通AI口型同步【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalker你是否也被一个问题卡住过想让人物出镜讲段话却拍不到合适的视频素材SadTalker 就是干这个的一张肖像照片加一段音频就能生成说话视频。它来自西安交通大学和腾讯 AI Lab已开源。下面带你从零跑通。 30秒认识它输入1张照片 1段音频输出口型同步的说话视频支持 256 / 512 像素两种渲染规格crop、resize、full 三种预处理模式可选 gfpgan 面部增强WebUI 界面与命令行两种用法它的底层是 3D 面部重建模型头部动作和表情比纯2D方法更稳这是最差异化的地方。 从零到跑通3步安装步骤环境要求Python 3.8GitFFmpeg启动步骤克隆仓库并进入目录git clone https://gitcode.com/GitHub_Trending/sa/SadTalker cd SadTalker运行bash webui.shWindows 双击webui.bat启动 WebUI自动装依赖。一键下载全部模型文件缺了它跑不出结果bash scripts/download_models.sh用一条命令生成视频跑完会提示结果文件路径python inference.py --driven_audio ./examples/driven_audio/bus_chinese.wav \ --source_image ./examples/source_image/full_body_1.png \ --enhancer gfpgan到results/目录按时间戳找到生成的 mp4直接播放检查效果。⚙️ 出效果的关键口型同步参数怎么调默认推荐参数直接能跑参数推荐值作用--preprocesscrop默认模式只动面部--size256渲染分辨率内存紧张选256--enhancergfpgan面部细节增强--expression_scale1.0表情强度基准值--still不加全身图时再加预处理模式怎么选crop是默认值只生成面部区域效果最稳。证件照类的正面图用resize。全身图用full并配合--still。选错模式是效果差的最常见原因。expression_scale 怎么调默认 1.0。表情显得平淡就调大到 1.2~1.5动作过夸张就调小到 0.8。一次只动这一个变量对比两次结果再定。全身模式为什么加 --still--still沿用原图姿态头部摆动更少全身画面更自然。再叠--enhancer gfpgan画质能再上一个台阶详见 最佳实践文档。️ 进阶玩法参考视频模式用--ref_eyeblink传入一段真人视频借它的眨眼和眉眼动作生成的眼神更自然。全身生成--preprocess full加--still人脸动画自动贴回原图身体部分保持不动。自由视角--input_yaw -20 30 10这类参数控制头部朝向变化单图即可转出多角度说话视频。 它能帮你做什么虚拟主播口播无需真人出镜照片角色按音频讲解批量产出内容课程与教学讲师照片配一段录音快速做出发音演示视频电商宣传店主照片读一段产品介绍省掉拍摄和后期 避坑清单ffmpeg is not recognized→ 安装 ffmpeg 并确认在系统 PATH 中Linux 可用conda install ffmpegFileNotFoundError: ...similarity_Lm3D_all.mat→ 模型没下载全重跑scripts/download_models.sh并核对目录报unexpected EOF文件损坏 → 模型没下完整重新下载 gfpgan 补丁包音频格式不对 → 输入音频请用 wav 或 mp3其他格式会解码报错CUDA 显存不足 → 运行前设置PYTORCH_CUDA_ALLOC_CONFmax_split_size_mb:128或把--size降到 256更多问题可以先翻 FAQ 文档多数报错都有现成答案。 下一步你现在已经能装环境、下模型、一条命令出片还会调预处理模式和表情强度这 3 个关键参数。剩下的就是多换几张图试手感了。现在就试试把第一支视频跑出来吧。示例素材目录examples/项目配置参考src/config/【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalker创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考