- Reduce peak VRAM by handling self_attn_mask more efficiently - Fallback to SDPA when self_attention_mask is used |
||
|---|---|---|
| .. | ||
| vae | ||
| vocoders | ||
| av_model.py | ||
| embeddings_connector.py | ||
| latent_upsampler.py | ||
| model.py | ||
| symmetric_patchifier.py | ||
- Reduce peak VRAM by handling self_attn_mask more efficiently - Fallback to SDPA when self_attention_mask is used |
||
|---|---|---|
| .. | ||
| vae | ||
| vocoders | ||
| av_model.py | ||
| embeddings_connector.py | ||
| latent_upsampler.py | ||
| model.py | ||
| symmetric_patchifier.py | ||
A Fortis Scientia site