This is your work, valued

Palo Alto, California

Anurag Koul

Expert
@koulanurag

Reinforcement Learning and Reasoning for Coding Agents

ma-gym. A collection of multi agent environments based on OpenAI gym.

632

muzero-pytorch. Pytorch Implementation of MuZero

356

minimal-marl. Minimal implementation of multi-agent reinforcement learning algorithms

59

mmn. Moore Machine Networks (MMN): Learning Finite-State Representations of Recurrent Policy Networks

52

visTorch. Interacting with Latent Space of AutoEncoder

21

dream-and-search. Code for "Dream and Search to Control: Latent Space Planning for Continuous Control"

12

conformal. Conformal prediction is a framework for providing accuracy guarantees on the predictions of a base predictor

9

gym-cartpole-continuous. CartPole env. with continuous action space

7

marl-pytorch. Pytorch Implementations of Multi Agent Reinforcement Learning(marl) algorithms

6

gym_x. Gym environments for capture properties of hidden states(hx) of recurrent networks.

5

variable-td3. Learning n-step actions for control tasks

4

opcc. Benchmark for "Offline Policy Comparison with Confidence"

3

deep-conformal. Applying Conformal Prediction over Deep Neural Nets

3

policybazaar. A collection of multi-quality policies for continuous control tasks.

3

maze-world. Random maze environments with different size and complexity for reinforcement learning research.

2

opcc-baselines. Baselines for "Offline Policy Comparison with Confidence"

1

pfa. Policy Fusion Architecture (PFA): We investigate policy gradient approaches for reward decomposition in reinforcement Learning

1

tensorboard2seaborn. Plot Tensorflow Summary Event in a Beautiful Way 🌈

1

vpn. PyTorch implementation of Value Prediction Network (VPN) :construction: :construction_worker:

1