LM4VisualEncoding. [ICLR 2024 (Spotlight)] "Frozen Transformers in Language Models are Effective Visual Encoder Layers"
245RandAR. [CVPR 2025 (Oral)] Open implementation of "RandAR"
208StreamingForecasting. [IROS 2023] "Streaming Motion Forecasting for Autonomous Driving"
41MR-Video. MR. Video: MapReduce is the Principle for Long Video Understanding
31ADDP. [ICLR 2025] Aligning Generative Denoising with Discriminative Objectives Unleashes Diffusion for Visual Perception
15PF-Track. [CVPR 2023] PF-Track (3D MOT for Autonomous Driving)
4SimpleTrack.
3