Skip to content

能否写个最小版的视频生成的推理代码 #9

Description

@makao007

很感谢开源这个项目,很想跑一下这个项目,但是显存不够。
我尝试修改代码,但目前的推理代码有点复杂,有的地方没看懂,修改失败。

为了节省显存,我的思路是,用到模型才加载,用完就卸载模型

步骤:

  1. 加载text_encoder , prompt -> text_embeddings_cond, 卸载 text_encoder
  2. 加载模型transformer, text_embeddings_cond -> latent , 卸载 transformer
  3. 加载 audio vae, 解码 audio latent, 卸载 audio vae ;
  4. 加载 video vae, 解码 video latent, 卸载 video vae;
  5. 合并视频音频信息,生成视频。

我改不出来,可以提供这样的推理脚本吗?

Metadata

Metadata

Assignees

No one assigned

    Labels

    No labels
    No labels

    Type

    No type

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions