ZeroSep. [NeurIPS 2025] Separate Anything in Audio with Zero Training
60FreSca. [CVPR 2025 GMCV] Test-Time Frequency Scaling: Instant Frequency Control for Any Diffusion Model
55DAVIS. [🏆 IJCV 2025 & ACCV 2024 Best Paper Honorable Mention] Official pytorch implementation of the paper "High-Quality Visually-Guided Sound Separation from Diverse Categories"
33Ego-AV-Loc. [CVPR 2023] Egocentric Audio-Visual Object Localization
27ScalingConcept. Python
24VisAH. [CVPR 2025] Pytorch implementation of the paper "Learning to Highlight Audio by Watching Movies"
15DRIFT. [ACL 2026] Fine Tuning MLLMs with Reasoning Priors from DeepSeekR1
8VisAH_Gallery. JavaScript
1