OpenVLA. 多模态具身智能大模型 OpenVLA 的复现以及在 LIBERO 数据集上的微调改进
RL. 上海交通大学《动手学强化学习》课程笔记,完成了所有算法实现,包括但不限于 Actor-Critic、PPO、DDPG、DQN等
LLaVA. 基于 Qwen2-0.5B 以及 SigLIP 实现的轻量化多模态风格化问答大模型