很感谢开源这个项目,很想跑一下这个项目,但是显存不够。
我尝试修改代码,但目前的推理代码有点复杂,有的地方没看懂,修改失败。
为了节省显存,我的思路是,用到模型才加载,用完就卸载模型。
步骤:
- 加载text_encoder , prompt -> text_embeddings_cond, 卸载 text_encoder
- 加载模型transformer, text_embeddings_cond -> latent , 卸载 transformer
- 加载 audio vae, 解码 audio latent, 卸载 audio vae ;
- 加载 video vae, 解码 video latent, 卸载 video vae;
- 合并视频音频信息,生成视频。
我改不出来,可以提供这样的推理脚本吗?
很感谢开源这个项目,很想跑一下这个项目,但是显存不够。
我尝试修改代码,但目前的推理代码有点复杂,有的地方没看懂,修改失败。
为了节省显存,我的思路是,用到模型才加载,用完就卸载模型。
步骤:
我改不出来,可以提供这样的推理脚本吗?