Researcher
CMTM. [ICIP 2025 Oral Paper] CMTM: Cross-Modal Token Modulation for Unsupervised Video Object Segmentation
Seen_to_Scene. [CVPR 2026 Findings Paper] Seen-to-Scene: Keep the Seen, Generate the Unseen for Video Outpainting