A machine for turning coffee into buggy code
Dropout-Q-Functions-for-Doubly-Efficient-Reinforcement-Learning. Source files to replicate experiments in my ICLR 2022 paper.
75Multi-Agent-Reinforcement-Learning-in-Stochastic-Games. Unofficial PyBrain extension for multi-agent reinforcement learning in general sum stochastic games.
70Dialogue-State-Tracking-using-LSTM. Source files to replicate experiments in my IWSDS 2016 paper.
22Learning-Robust-Options-by-Conditional-Value-at-Risk-Optimization. Source files to replicate experiments in my NeurIPS 2019 paper.
11Active-Learning-for-Example-based-Dialog-Systems. Source files to replicate experiments in my IWSDS 2016 paper.
8Which-Experiences-Are-Influential-for-RL-Agents. Source files to replicate experiments in my RLC 2025 paper.
8Reinforcement-Learning-in-Multi-Party-Trading-Dialog. Source files to replicate experiments in my SigDial 2015 and JSAI papers.
7Efficient-SRGC-RL-with-a-High-RR-and-Regularization. Source files to replicate experiments in my Arxiv 2023 paper.
1Meta-Model-Based-Meta-Policy-Optimization. Source files to replicate experiments in my ACML 2021 paper.
1Mujoco-Wasm-Playground. My MuJoCo WASM playground for educational purposes
1LeRobot-Playground. My LeRobot playground for educational purposes
1