Xiaoyu Song, Dezhi Han, Chongqing Chen, Xiang Shen, Huafeng Wu: Vman: visual-modified attention network for multimodal paradigms. Vis. Comput. 41(4): 2737-2754 (2025)