相关链接:
#104 (comment)
digit 数字人是基于 infinitetalk 实现lip-sync.
另外一个workflow i2v_ltx2.json (2011258580393009153) 是直接在prompt 嵌入对话,通过模型在 video_audio的latent空间内生成的。
然而,我看到还有一些workflow, 如vido_qwen_wan2.2.json(1993608528969531394), video_wan2.2.json(1991693844100100097) video_wan2.1_fusion.json(1985909483975188481) 都只是生成没有audio的视频,那这些视频后续的lip-sycn是如何实现的呢?
相关链接:
#104 (comment)
digit 数字人是基于 infinitetalk 实现lip-sync.
另外一个workflow i2v_ltx2.json (2011258580393009153) 是直接在prompt 嵌入对话,通过模型在 video_audio的latent空间内生成的。
然而,我看到还有一些workflow, 如vido_qwen_wan2.2.json(1993608528969531394), video_wan2.2.json(1991693844100100097) video_wan2.1_fusion.json(1985909483975188481) 都只是生成没有audio的视频,那这些视频后续的lip-sycn是如何实现的呢?