music. Mutual Information State Intrinsic Control (ICLR 2021 Spotlight)
39EnergyBasedPrioritization. Energy-Based Hindsight Experience Prioritization (CoRL 2018) Oral presentation (7%)
35maximum_entropy_population_based_training. Maximum Entropy Population Based Training for Zero-Shot Human-AI Coordination
26mep. Maximum Entropy-Regularized Multi-Goal Reinforcement Learning (ICML 2019)
24GuessWhat-TemperedPolicyGradient. Learning Goal-Oriented Visual Dialog via Tempered Policy Gradient (SLT 2018) (IJCAIw 2018)
7MNIST-GuessNumber. Efficient Dialog Policy Learning via Positive Memory Retention (SLT 2018) (NIPSw 2018)
7PositiveMemoryRetention. Efficient Dialog Policy Learning via Positive Memory Retention (SLT 2018) (NIPSw 2018)
3alf. Agent Learning Framework https://alf.readthedocs.io
2