Zerui Chen, Shizhe Chen, Etienne Arlaud, Ivan Laptev, Cordelia Schmid: ViViDex: Learning Vision-Based Dexterous Manipulation from Human Videos. ICRA 2025: 3336-3343