MMIRL: a multimodal framework for learning robotic manipulation from RGB-D demonstrations
Extracting robot-reproducible manipulation skills from human RGB-D demonstrations requires stable object identities under multi-object occlusion and a conversion from continuous observations to structured demonstrations. MMIRL addresses this setting with a modular two-stage framework for tabletop manipulation. Offline,...