I am Han Zhang, a Researcher at the AI Laboratory.
Hetero-RL. Group Expectation Policy Optimization for Heterogeneous Reinforcement Learning
ARL-MACR. Code for Asynchronous Reinforcement Learning for Multi-Agent Cooperation-Based Reasoning
HanlardResearch.github.io.