This is your work, valued
Deep Reinforcement Learning
BPPO. Author's Pytorch implementation of ICLR2023 paper Behavior Proximal Policy Optimization (BPPO).
Reinformer. Official code for ICML 2024 paper Reinformer: Max-Return Sequence Modeling for offline RL