


default search action
MMM 2025, Nara, Japan - Part I
- Ichiro Ide

, Ioannis Kompatsiaris
, Changsheng Xu
, Keiji Yanai
, Wei-Ta Chu
, Naoko Nitta, Michael Riegler
, Toshihiko Yamasaki
:
MultiMedia Modeling - 31st International Conference on Multimedia Modeling, MMM 2025, Nara, Japan, January 8-10, 2025, Proceedings, Part I. Lecture Notes in Computer Science 15520, Springer 2025, ISBN 978-981-96-2053-1
Regular Papers
- Zhaoxin Chen

, Bo Ma
:
A Dual-Branch Model for Color Constancy. 3-15 - Wenxu Du, Aishan Wumaier

, Yahui Shi, Nian Yi, Dehua Liu:
A Multi-aspect Multi-granularity Pronunciation Assessment Method Based on Branchformer Encoder and Hierarchical Aggregation. 16-29 - Bo Xu, Haiqi Jiang, Shouang Wei, Ming Du, Hui Song, Hongya Wang:

A Multi-expert Collaborative Framework for Multimodal Named Entity Recognition. 30-43 - Yuefeng Ma, Zhiqi Cheng, Deheng Liu, Shiying Tang:

A Novel Human Abnormal Posture Detection Method Based on Spatial-Topological Feature Fusion of Skeleton. 44-57 - Élise Lincker

, Camille Guinaudeau
, Shin'ichi Satoh
:
AD2AT: Audio Description to Alternative Text, a Dataset of Alternative Text from Movies. 58-71 - Tiebiao Wang, Zhenchao Cui, Xiaoyang Li

:
AMFT-YOLO: A Adaptive Multi-scale YOLO Algorithm with Multi-level Feature Fusion for Object Detection in UAV Scenes. 72-85 - Xiaoman Xu, Xiangrun Li, Taihang Wang, Ye Jiang:

AMPLE: Emotion-Aware Multimodal Fusion Prompt Learning for Fake News Detection. 86-100 - Armand Losfeld

, Nicolas Seznec, Laurie Van Bogaert
, Gauthier Lafruit
, Mehrdad Teratani
:
An Analytical Method for Rendering Plenoptic Cameras 2.0 on 3D Multi-layer Displays. 101-110 - Xiangyu Chen

, Shin'ichi Satoh
:
Balancing Efficiency and Accuracy: An Analysis of Sampling for Video Copy Detection. 111-124 - Jin Yan Lv, Guo Qiang Xiao:

BiCA-YOLO: Bidirectional Feature Enhancement and Cross Coordinate Attention for Small Object Detection. 125-138 - Minghui Hou

, Gang Wang, Zhiyang Wang, Tongzhou Zhang
, Baorui Ma
:
BLCC: A Benchmark for Multi-LiDAR and Multi-camera Calibration. 139-152 - Ling Jiang

, Zhuocheng Liu
, Kaige Li
, Wei Wu
:
Boosting Human Pose Estimation via Heatmap Refinement. 153-167 - Jinyang Wang, Wei Wu

:
Camouflaged Object Detection Based on Localization Guidance and Multi-scale Refinement. 168-181 - Hao Wu, Danping Yang, Peng Liu, Xianxian Li:

Chain of Thought Guided Few-Shot Fine-Tuning of LLMs for Multimodal Aspect-Based Sentiment Classification. 182-194 - Jian Zhu, Mingkai Sheng, Zhangmin Huang, Jingfei Chang, Jinling Jiang, Jian Long, Cheng Luo, Lei Liu:

CLIP Multi-modal Hashing for Multimedia Retrieval. 195-205 - Lucia Vadicamo

, Francesca Scotti, Alan Dearle
, Richard Connor
:
Comparative Analysis of Relevance Feedback Techniques for Image Retrieval. 206-219 - Guanli Chen, Guoheng Huang, Xiaochen Yuan, Xuhang Chen

, Guo Zhong, Chi-Man Pun:
Cross-View Geo-Localization via Learning Correspondence Semantic Similarity Knowledge. 220-233 - Guofeng Li, Hanxi Li, Bo Li, Lin Wu, Yan Cheng:

DART: Depth-Enhanced Accurate and Real-Time Background Matting. 234-248 - Wenchuan Mu

, Kwan Hui Lim
:
Data-Free Functional Projection of Large Language Models onto Social Media Tagging Domain. 249-262 - Yongqing Sun

, Hong Liu
, Qiong Chang
, Xianhua Han
:
Deep Dual Internal Learning for Hyperspectral Image Super-Resolution. 263-276 - Kosei Suyama, Kazuaki Nakamura

:
Detoxification of Unlabeled Dataset: Reducing Implicit Class Imbalance Using Pseudo-Jacobian of GAN's Generator. 277-290 - Le Yu, Xianchao Zhang, Shuxia Qian, Hong Sun:

DistillSleep: Leverage Self-distillation to Improve Performance After Representation Learning for Sleep Staging. 291-303 - Miaolin Han, Huibin Li:

DocMamba: Robust Document Image Dewarping via Selective State Space Sequence Modeling. 304-318 - Ying Sun, Meiyi Wei, Gang Chen:

Dual-Task Feedback Learning for Tongue Detection via Super-Resolution Integration. 319-332 - Nico Hezel

, Kai Uwe Barthel
, Bruno Schilling
, Konstantin Schall
, Klaus Jung
:
Dynamic Exploration Graph: A Novel Approach for Efficient Nearest Neighbor Search in Evolving Multimedia Datasets. 333-347 - Zhensu Wang, Weilong Peng, Le Wang, Zhizhe Wu, Peican Zhu, Keke Tang:

EIA: Edge-Aware Imperceptible Adversarial Attacks on 3D Point Clouds. 348-361 - Qinfeng Zhu

, Ningxin Weng
, Lei Fan
, Yuanzhi Cai
:
Enhancing Environmental Monitoring Through Multispectral Imaging: The WasteMS Dataset for Semantic Segmentation of Lakeside Waste. 362-372 - Zhihui Zhang

, Xiaoshuai Hao, Jianan Li
, Jinhui Pang:
ESC-MISR: Enhancing Spatial Correlations for Multi-image Super-Resolution in Remote Sensing. 373-387 - Zhongzhan Huang, Mingfu Liang, Senwei Liang, Shanshan Zhong

:
Flat Local Minima for Continual Learning on Semantic Segmentation. 388-400 - Yuki Imajuku, Yoko Yamakata

, Kiyoharu Aizawa
:
FoodMLLM-JP: Leveraging Multimodal Large Language Models for Japanese Recipe Generation. 401-414 - Tao Song, Wenwen Zhang:

Frequency-Aware Convolution for Sound Event Detection. 415-426 - Haodian Wang:

Frequency-Based Unsupervised Low-Light Image Enhancement Framework. 427-439 - Sijia Han, Zhibin Zhang:

GFA-UDIS: Global-to-Flow Alignment for Unsupervised Deep Image Stitching. 440-454

manage site settings
To protect your privacy, all features that rely on external API calls from your browser are turned off by default. You need to opt-in for them to become active. All settings here will be stored as cookies with your web browser. For more information see our F.A.Q.


Google
Google Scholar
Semantic Scholar
Internet Archive Scholar
CiteSeerX
ORCID













