PanoGen. Code and Data for Paper: PanoGen: Text-Conditioned Panoramic Environment Generation for Vision-and-Language Navigation
83SELMA. Code and Data for Paper: SELMA: Learning and Merging Skill-Specific Text-to-Image Experts with Auto-Generated Data
35VLN-SIG. Python
35EnvEdit. Pytorch Code and Data for EnvEdit: Environment Editing for Vision-and-Language Navigation (CVPR 2022)
30Video-MSG. Training-free Guidance in Text-to-Video Generation via Multimodal Planning and Structured Noise Initialization
28SyntaxVLN. Code for Paper "Improving Cross-Modal Alignment in Vision Language Navigation via Syntactic Information", NAACL 2021
8CLEAR. Code and Model for Paper "CLEAR: Improving Vision-Language Navigation with Cross-Lingual, Environment-Agnostic Representations"
6