Cailyn Smith, Haoran Hao, Abien Cherian
Random Agent
On-Policy Agent (PPO)
Off-Policy Agent (SAC)
Model-based Agent (MBPO)
Modification 1 PPO-vision
Modification 2 Warmstart with Imitation Learning
Modification 3 Diffusion Policy with PPO expert
Performance