This is your work, valued
maxrl. Official Implementation of "Maximum Likelihood Reinforcement Learning (MaxRL)"
200srt. Official implementation for the paper "Can Large Reasoning Models Self-Train?"
76paprika. Official Code Release for "Training a Generally Curious Agent"
48proactive_interventions. Codebase for NeurIPS 2022 paper, "When to Ask for Help: Proactive Interventions in Autonomous Reinforcement Learning"
9OOD_Detection_Inconsistency. Project Code for ICML UDL Workshop 2021 Submission
8dcm. Codebase for "Conservative Prediction via Data-Driven Confidence Minimization"
2