SadTalker
上传单张人像与驱动音频,生成包含口型、表情和头部动作的说话视频。
人像图片
Drop Image Here
- or -
Click to Upload
驱动音频
Drop Audio Here
- or -
Click to Upload
生成设置
▼
图片预处理
裁剪人脸(推荐)
完整图片
扩展裁剪
扩展完整图片
缩放图片
静止模式(减少头部运动,适合完整图片)
姿态风格
↺
0
45
表情强度
↺
0.5
2
生成视频
生成结果
首次生成需要加载模型,耗时会更长。建议使用正面、无遮挡、光线均匀的人像和 30 秒以内的清晰语音。