Weimian Li, Wenmin Wang, Xiongtao Chen, Jinzhuo Wang, Ge Li: A joint model for action localization and classification in untrimmed video with visual attention. ICME 2017: 619-624