


default search action
ICME 2025: Nantes, France - Workshops
- IEEE International Conference on Multimedia and Expo, ICME 2025 - Workshops, Nantes, France, June 30 - July 4, 2025. IEEE 2025, ISBN 979-8-3315-8743-7

- Yunpeng Wei, Hengyue Bi, Yimei Liu, Jinghao Sun, Yingyu Wang, Lin Qi, Junyu Dong, Hao Fan:

Stereo Vision SLAM for Real-time Underwater Dense 3D Mapping. 1-6 - Xuli Guo, Ce Li, Zhongbo Jiang, Fang Wan:

2s-TAS: Two-Stream Transformer for Multi-modal Human Action Segmentation. 1-6 - Siqi Yu

, Yiqing Tian, Suwan Chen:
Future Archaeological Archive: Exploring Narrative Entropy in AI-Generated Ecological Speculations. 1-2 - Zhengya Gong

, Yang Liu
, Henglin Shi, Georgi V. Georgiev, Jonna Häkkilä:
Bridging Cultures: A Framework for Facial Expression and Empathy. 1-6 - Xinyu Lin

, Yingjie Zhou, Yipeng Liu, Zhen Long, Ce Zhu:
A High-Precision, Low-Latency, and Robust Vision-Based Localization System for Embodied Intelligent Robots in Complex Environments. 1-2 - Tzvi Tal Noy

, Ido Sagi, Nurit Spingarn-Eliezer:
SinBMI: Estimating BMI from a Single Image. 1-2 - Monan Zhou, Xiaobing Li, Feng Yu, Wei Li:

EMelodyGen: Emotion-Conditioned Melody Generation in ABC Notation with the Musical Feature Template. 1-6 - Tiange Zhou, Marco Bidin:

Empowering Non-Technical Humanities Scholars with AI-Driven Tools: An Accessible Framework for Poetry Analysis. 1-6 - Minh Hoang

, Tero Partanen
, Guillaume Gautier
, Alexandre Mercat
, Joni Räsänen
, Jarno Vanne
:
Demonstration of Energy-Efficient Saliency-Guided Video Communication. 1-2 - Ajeet Kumar Verma

, Shweta Tripathi, Vinit Jakhetiya, Badri N. Subhdhi, Sunil Jaiswal:
ScrVSR: Screen Sharing Video Super-Resolution. 1-6 - Fei Zhao, Runlin Zhang, Chengcui Zhang, Nitesh Saxena:

MarkMatch: Same-Hand Stuffing Detection. 1-2 - Carey Bunks, Simon Dixon, Bruno Di Giorgi:

Analysis of Improvised Jazz Melodies Using Harmonic Tags. 1-6 - Songru Yang, Yapeng Meng, Zhenwei Shi, Zhengxia Zou:

Text-driven Physically Interpretable Face Editing. 1-6 - Zhi Li, Zijian Sun, Xin Ding, You Yang, Qiong Liu:

UW-HSPPE: Leveraging Human Skeleton Priors for Robust Underwater Pose Estimation. 1-6 - Ronghua Cai

, James She:
Liquor Inspiration: AI Art with Chinese Calligraphy Painting and Drinking Culture. 1-7 - Aizierjiang Aiersilan, Zhiqiang Wang:

A 3D Framework for Improving Low-Latency Multi-Channel Live Streaming. 1-6 - Ahmed Hassanein, Mahmoud Reza Hashemi, Shervin Shirmohammadi:

AI-Assisted Edge Server Selection in 5G for Low-Latency Multimedia Applications. 1-6 - Qinyan Li, James She:

AI-Assisted Curation: A Framework for Curatorial Materials. 1-7 - Xiaoyu Zhang, Teng Zhou, Xinlong Zhang, Jia Wei, Yongchuan Tang:

Multi-Scale Diffusion: Enhancing Spatial Layout in High-Resolution Panoramic Image Generation. 1-6 - Qinglan Wei, Yahui Shen, Shenyangyang Liu, Wei Zhong

, Long Ye:
AIGC-Powered Fine-Grained Emotional Digital Art Generation. 1-4 - Xiaobai Li, Xinglong Mao, Hao Zou, Jingjing Chen, Sirui Zhao

:
Cross-Cultural Nuances of Micro-Expressions and Action Units: A Comparative Study. 1-6 - Zhe Hou, Xinghui Dong

:
EG-ISNet: An Edge-Guided Image Stitching Network for Drone-Captured Ship Hull Images. 1-6 - Yuchao Luo:

Gazing into the Loop: An Artistic Take on Machine Subjectivity. 1-2 - Xinyue Ju, Yipeng Xu, Gang Yang:

Adaptive Prompt Modifier for Text-to-Image Model. 1-6 - Wei Sun, Linhan Cao, Kang Fu, Dandan Zhu, Jun Jia, Menghan Hu, Xiongkuo Min, Guangtao Zhai:

CompressedVQA-HDR: Generalized Full-reference and No-reference Quality Assessment Models for Compressed High Dynamic Range Videos. 1-6 - Alexandros Gkillas, Nikos Piperigkos, Aris S. Lalos:

Guided Model-based LiDAR Super-Resolution for Resource-Efficient Automotive scene Segmentation. 1-6 - Yefei Huang, Wei Zhong

, Fei Hu, Long Ye, Qin Zhang:
RPGCN-GDA: Regionally Progressive Graph Convolutional Network with Gender-Sensitive Domain Adaptation for EEG Emotion Recognition. 1-6 - Linus P. Müller, Michel Bätz, André Berg, Timothy Gray, Muhammad Shahzeb Khan Gul, Christian Schinabeck, Joachim Keinert:

Benchmarking Learnable Mesh and Texture Representations for Immersive Digital Twins. 1-6 - Lin Wang, Xinghui Dong

:
DSDMNet: A Dual-Supervised Distraction Mining Network for Underwater Image Segmentation. 1-6 - Huai-Qian Khor, Yante Li, Xingxun Jiang, Guoying Zhao:

Is Micro-expression Ethnic Leaning? 1-6 - Yujie Huang, Alexandre Bruckert, Patrick Le Callet:

Towards Accessible Visual Field Self-Assessment: An Eye-Tracker-Assisted Virtual Reality Perimetry. 1-2 - Kan Guo, Yan Shao, Haijun Lu, Hong Luo:

Harnessing Portrait Visuals and Furniture Object for Creative Home Furnishing Design Generation. 1-2 - Jingguo Liu, Han Yu, Shigang Li, Jianfeng Li:

360-Degree Full-view Image Segmentation by Spherical Convolution compatible with Large-scale Planar Pre-trained Models. 1-6 - Gui Zou, Chaofan Gan, Chern Hong Lim

, Supavadee Aramvith, Weiyao Lin:
MCA: 2D-3D Retrieval with Noisy Labels Via Multi-Level Adaptive Correction and Alignment. 1-6 - Eric Browne, Michael Clemens:

AI Music Artist Toolkit (AIMAT) - A Modular Environment for Experimenting with AI in Music. 1-7 - Jakub Pocwiardowski, Mateusz Modrzejewski, Marek S. Tatara:

M6(GPT)3: Generating Multitrack Modifiable Multi-Minute MIDI Music from Text using Genetic Algorithms, Probabilistic Methods and GPT Models in any Progression and Time Signature. 1-6 - Vineet Suryan, Aaron Boxer, Marcus Edel:

Super-Resolution Via Mixture-of-Experts. 1-4 - Maria Damanaki, Nikos Piperigkos, Alexandros Gkillas, Aris S. Lalos:

Optimizing Cooperative Multi-Object Tracking using Graph Signal Processing. 1-6 - Yuhang Liu, Huibin Kang, Hengan Liu, Jiayi Su, Keng-Lun Chang, Jiaqing Lyu, Bo Wan:

Robust 3D Human Pose Estimation with Unsynchronized Cross-View Fusion. 1-6 - Dounia Hammou

, Fei Yin, Rafal K. Mantiuk:
ColorVideoVDP-ML: Visual Difference Predictor with a neural regressor for image and video quality prediction. 1-6 - Yuehan Lee, Yi Qin:

MIR Tracks: A Large-Scale Multi-Dimensional Multi-Track Music Dataset. 1-5 - Yu-Lun Chiou, Pu Ching, Min-Chun Hu:

Enhancing Activity Recognition: Motion Waveform Preprocessing from Millimeter-Wave Radar Data for Transformer-Based Classification. 1-6 - Zixuan Wang, Mingfu Yan, Zhenping Li, Yuchen Guo, Bin Fu:

Multi-LoRA Composition for Efficiently Learning Fine-Grained Font Styles. 1-6 - Zhen Luo, Jiahao Xia, Wenbo Xu, Qiang Wu

, Jian Zhang
:
Robust Automated-monitoring System for Laying Hen Behaviors on Commercial Egg Farms. 1-2 - Andrew C. Freeman

:
Toward Accessible and Safe Live Streaming Using Distributed Content Filtering with MoQ. 1-6 - Haijing Jia, Hong Yi, Hengzhi Zhang, Yupeng Zhang, Liyan Liu:

A Multi-element Anomaly Detection Approach for Complex Industrial Images. 1-6 - Jie Li, Haitao Ren, Jinao Song, Yingyu Wang, Yongle Zhang, Hao Fan, Junyu Dong:

UMB-GSfM: Underwater Marker-Based Global Structure-from-Motion. 1-6 - Dan Song, Boao Song, Xinwei Fu, Wenhui Li, An-An Liu:

MF-Adapter: Better 3D Foundation Model with Multimodal Fusion Adapter. 1-6 - Luntian Mou, Yuliang Zhang, Yihan Sun, Feng Gao, Yong Xiang:

Multitrack Music Generation Combining Transformer and Diffusion Model. 1-6 - Haonan Cheng, Hongfei Wang

, Lingxiao Niu, Yuanyuan Zhang, Zhenghao Jiang, Xiaoping Hou, Xiaojie Hao, Yuxin Shen, Long Ye:
FSD 2.0: Improved Fake Song Dataset for Unknown-domain Deepfake Detection. 1-6 - Ivan V. Bajic, Teo Saeedi-Bajic, Kai Saeedi-Bajic:

Pack Your Lunch : A Metaverse Game to Help Youngsters Make Informed Nutrition Choices. 1-2 - Maxime Jouin, Stéphane Pateux, Matthieu Gendrin, Sylvain Kervadec, Christophe Daguet, Patrick Gioia, Stéphane Denis:

3D Gaussian Splatting and mixed-reality applications. 1-2 - Hanyu Jiang

, Jian Xue, Xing Lan, Guohong Hu, Ke Lu:
MVLLaVA: An Intelligent Agent for Unified and Flexible Novel View Synthesis. 1-6 - Jihong Xie, Shiyun Liu, Xiaodi Sun, Xiangdong Huang, Lin Gan:

A Visualization Method and Application of Composition Based on Dynamic Clock Spiral. 1-6 - Nheelam Mitthera Nandagobalan, Lai-Kuan Wong, Patrick Le Callet, Fabian Wai-Lee Kung, John See

:
Uncovering Cross-Cultural Emotional Patterns: t-SNE and PCA on Micro-Expressions. 1-6 - Xi Shi, Lingli Chen, Peng Wei, Xi Wu, Tian Jiang, Yonggang Luo, Lecheng Xie:

DHGS: Decoupled Hybrid Gaussian Splatting for Driving Scene. 1-6 - Bolin Wang, Kejun Zhang:

Exploring Chinese Text Generation And Typography Using Diffusion Models. 1-6 - Mingyu Mao, Shuxian Li, Yuhao Cheng, Long Chen, Dandan Sun, Hongda Li, Xinyue Fan:

Decoupled Depth-guided Coordinate-aware Network for 3D Human Pose and Shape Estimation. 1-6 - Sitare Arslantürk, Engin Erzin:

ARTMV: A Cross-Modal Art Music Video Dataset for Proprioceptive Valence Perception. 1-6 - Jingguo Liu, Jiayao Liu, Yujie Wang, Shigang Li, Jianfeng Li:

A Twin-network Architecture for RGB-based Panoramic Semantic Segmentation. 1-6 - Jaza Syed, Ivan Meresman Higgs, Ondrej Cífka, Mark Sandler:

Exploiting Music Source Separation for Automatic Lyrics Transcription with Whisper. 1-6 - Ei Kyi Phyu Khin, Yuan-Chun Sun, Cheng-Hsin Hsu:

Evaluating Cloud VR Gaming Experience over LEO Satellite and 5G mmWave Networks. 1-6 - Babak Naderi, Ross Cutler, Juhee Cho, Nabakumar Singh Khongbantabam, Dejan Ivkovic:

ICME 2025 Grand Challenge on Video Super-Resolution for Video Conferencing. 1-6 - Hongtao Yang, Yehui Liu, Ping Shi, Xin Jin, Shuiping Fang, Shujiang Xie:

Prompt-Guided Aesthetic Assessment with Cross-Modal Semantic Alignment. 1-6 - Ce Li, Shuo Li, Xinyi Duan, Bei Guan:

Improved Pipeline Disease Grading Detection Method for Visual Inspection of Sewer Pipeline Robots. 1-6 - Sébastien Piérard, Adrien Deliège, Anaïs Halin, Marc Van Droogenbroeck:

A Methodology to Evaluate Strategies Predicting Rankings on Unseen Domains. 1-6 - Xiaolong Guo, Min Wang, Hui Wu, Wengang Zhou, Houqiang Li:

Keypoint Ensemble For Image Matching. 1-6 - Mengyan Li, Huijie Gu, Jianmeng Zhou, Shiwei He, Yingjuan Jia, Tong Chen

:
StO2 Stress Recognition Based on Deformable Convolution and Multimodal Feature Blender. 1-6 - Zafer Gurel, Ali C. Begen, Saba Ahsan, Kashyap Kammachi Sreedhar, Serhan Gül:

Track Switching Made Easy in Media-Over-Quic Transport. 1-6 - Wala Elsharif, Mahmoud Alzubaidi

, James She, Marco Agus:
Ara-Pic: A Framework for Enhancing Arabic Cultural Representation in AI-Generated Images. 1-6 - Zongyun Zhang, Xian Gao, Jiacheng Ruan, Ting Liu, Yuzhuo Fu:

RIASA: Enhancing Reasoning Industrial Anomaly Segmentation via Large Vision-Language Models. 1-6 - Yu Xu, Xiaokai Qin, Tianyu Fan, Eng Siong Chng, Sheng Li

, Nobuaki Minematsu, Daisuke Saito:
Bandwidth Extension System for Throat Microphone Speech Reconstruction. 1-2 - Chang Xie, Chenyi Zhuang, Pan Gao:

PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models. 1-6 - Linchen Xu, Xin Liu, Zhibin Chen, Jun Wang, Fan Liang:

Low-Latency H.264/AVC Encoder Hardware Design with Wavefront Parallelism on FPGA Platform. 1-6 - Jingge Guan, Bing Han, Xinbo Gao, Zhi-Hui Zhan:

FusionAttNet: A Water Surface Object Detection Model with Dynamic Fusion and Cross-Modal Attention. 1-6 - Zihao Wang, Jingchao Cao, Song Ma, Hao Fan:

Enhancing Underwater Images with KAN and Attention Mechanism. 1-5 - Juri Etto, Kuisma Hurtig, Pavlo Ivanov, Zhengya Gong

, Ashley Colley, Jonna Häkkilä:
Gamified Sustainability: Virtual Reality Escape Room for Recycling Education. 1-2 - Haofeng Wang, Yilin Guo, Zehao Li, Tong Yue, Yizong Wang, Enci Zhang, Rongqun Lin, Feng Gao, Shiqi Wang, Siwei Ma:

RiverEcho: Real-Time Interactive Digital System for Ancient Yellow River Culture. 1-6 - Yongjun Wu, Parminder Singh, Kyle Koceski, Mairo Pedrini:

Audio Video Synchronization in Content Stitching. 1-4 - Ching-Hsun Chang, Ming-Hao Lee, Yu-Hsuan Chiu

, Yi-Min Liao, Sheng-Luen Chung, Gee-Sern Hsu:
Efficient Face Recognition via Representative Synthetic Data. 1-6 - Kaicheng Xu

, An Wei, Congxuan Zhang, Zhen Chen, Peng Liu, Ke Lu:
A Robust Deep Retinex Decomposition Network Leveraging a Novel Synthetic Dataset for Low-Light Image Enhancement. 1-6 - Qian Yin, Haopeng Lu, Mingjia Yang, Ruiqi Li, Yizong Wang, Lili Zhao, Sujia Wang, Xinfeng Zhang, Siwei Ma:

LIVE-FIT: LED-based Immersive Virtual Environment with Fusion, Interaction, and Transmission. 1-6 - Jingge Zhao, Xiaobing Li, Weipeng Wang, Yan Gao, Xiaoqing Wang, Yun Tie:

Video-driven cross-modal controlled music generation. 1-6 - Baojun Li:

Multimodal Large Language Model for HDR & SDR Video Quality Measurement. 1-3 - Zeyu Liu, Taiheng Ye, Yiming Li, Chen Song, Yi Xu:

ArtisanFlow: Style Customization System for Illustration Generation. 1-6 - Yixu Chen, Bowen Chen, Hai Wei, Alan C. Bovik, Baojun Li, Wei Sun, Linhan Cao, Kang Fu, Dandan Zhu, Jun Jia, Menghan Hu, Xiongkuo Min, Guangtao Zhai, Dounia Hammou, Fei Yin, Rafal K. Mantiuk, Amritha Premkumar, Prajit T. Rajendran, Vignesh V. Menon:

ICME 2025 Generalizable HDR and SDR Video Quality Measurement Grand Challenge. 1-6

manage site settings
To protect your privacy, all features that rely on external API calls from your browser are turned off by default. You need to opt-in for them to become active. All settings here will be stored as cookies with your web browser. For more information see our F.A.Q.


Google
Google Scholar
Semantic Scholar
Internet Archive Scholar
CiteSeerX
ORCID













