This is your work, valued
Bridge-LLM-reasoning. Behavior Injection: Preparing Language Models for Reinforcement Learning (NeurIPS 2025)
17FCSRL. Feasibility Consistent Representation Learning for Safe Reinforcement Learning (ICML 2024). Current SOTA model-free safe RL algorithm on safety-gymnasium
17cde-offline-rl. Learning from Sparse Offline Datasets via Conservative Density Estimation (ICLR 2024)
3