This is your work, valued
wesam. [CVPR 2024] Code for "Improving the Generalization of Segmentation Foundation Model under Distribution Shift via Weakly Supervised Adaptation"
180LetsTalk. [IEEE TMM] Multimodal Diffusion Transformer with Memory Bank for Scalable Long-Duration Talking Video Generation
62MuSS. A Large-Scale Dataset and Cinematic Narrative Benchmark for Multi-Shot Subject-to-Video Generation
28cogvideo-factory. Memory-optimized training scripts for video models based on Diffusers
1lightning-Latte. Latte: Latent Diffusion Transformer for Video Generation.
1