This is your work, valued
Research Scientist arip.asadulaev@mbzuai.ac.ae
Zero-Shot-Off-Policy-Learning. Official Pytorch Implementation of "Zero-Shot Off-Policy Learning" (ICML 2026)
25General-Cost-Neural-Optimal-Transport. Official Pytorch implementation of "Neural Optimal Transport with General Cost Functionals" (ICLR 2024)
24Deep-Improvement-Supervision. Official PyTorch implementation of "Latent Reasoning in TRMs is Secretly a Policy Improvement Operator" (ICML 2026)
23Y-Shaped-Generative-Flows. Official Pytorch Implementation of "Y-Shaped Generative Flows"
9Partial-Policy-Learning. Official JAX implementation of "Rethinking Optimal Transport in Offline Reinforcement Learning" (NeurIPS 2024)
5