Compute upstream VAE temporal overlap constants
This commit is contained in:
parent
81714ed50f
commit
b73d08b231
1 changed files with 4 additions and 2 deletions
|
|
@ -162,8 +162,10 @@ class MiniMaxH3VideoVAE(nn.Module):
|
|||
super().__init__()
|
||||
self.vae_ratio, self.vae_ratio_t = 16, 4
|
||||
self.clip_length, self.token_drop = 17, 3
|
||||
self.tokens_chunk_size, self.token_overlap = 5, 3
|
||||
self.frame_pre_padding, self.frame_overlap = 3, 9
|
||||
self.frame_pre_padding = (-self.clip_length) % self.vae_ratio_t
|
||||
self.tokens_chunk_size = math.ceil(self.clip_length / self.vae_ratio_t)
|
||||
self.token_overlap = (-self.token_drop) % self.tokens_chunk_size
|
||||
self.frame_overlap = max(self.token_overlap * self.vae_ratio_t - self.frame_pre_padding, 0)
|
||||
self.tiling, self.tile_size, self.tile_overlap_min = tiling, 256, 64
|
||||
self.post_quant_conv = nn.Conv3d(24, 24, 1, device=device)
|
||||
self.decoder = ViT3DDecoder(device=device)
|
||||
|
|
|
|||
Loading…
Add table
Reference in a new issue