This is your work, valued
transformerXL_PPO_JAX. Python
post--diffLenia. JavaScript
imgc-marl. Jupyter Notebook
agri_RL_trXL. Python
jonbarron.github.io. HTML
rejax. Hardware-Accelerated Reinforcement Learning Algorithms in pure Jax!
xland-minigrid-datasets. XLand-100B: A Large-Scale Multi-Task Dataset for In-Context Reinforcement Learning - - — ICLR 2025
vivarium. Multi-agent simulator in Jax for research and teaching in AI & ALife
xland-minigrid. JAX-accelerated Meta-Reinforcement Learning Environments Inspired by XLand and MiniGrid 🏎️
cleanrl. High-quality single file implementation of Deep Reinforcement Learning algorithms with research-friendly features (PPO, DQN, C51, DDPG, TD3, SAC, PPG)
episodic-transformer-memory-ppo. Clean baseline implementation of PPO using an episodic TransformerXL memory