ogbench. A benchmark for offline goal-conditioned RL and offline RL
444fql. The official implementation of flow Q-learning (FQL)
321horizon-reduction. The official implementation of "Horizon Reduction Makes RL Scalable"
200HILP. Foundation Policies with Hilbert Representations (ICML 2024)
104HIQL. HIQL: Offline Goal-Conditioned RL with Latent States as Actions (NeurIPS 2023)
98METRA. METRA: Scalable Unsupervised RL with Metric-Aware Abstraction (ICLR 2024)
93LSD. Lipschitz-constrained Unsupervised Skill Discovery (ICLR 2022)
39PMA. Predictable MDP Abstraction for Unsupervised Model-Based RL (ICML 2023)
33CSD-manipulation. Controllability-Aware Unsupervised Skill Discovery (ICML 2023)
33CSD-locomotion. Controllability-Aware Unsupervised Skill Discovery (ICML 2023)
30SAR. Time Discretization-Invariant Safe Action Repetition for Policy Gradient Methods (NeurIPS 2021)
6