


default search action
21st VISAPP 2026: Marbella, Spain - Volume 1
- Antonino Furnari, Petia Radeva:

Proceedings of the 21st International Conference on Computer Vision Theory and Applications, VISAPP 2026, Marbella, Spain, March 9-11, 2026, Volume 1. SCITEPRESS 2026, ISBN 978-989-758-804-4
Invited Speakers
- Elisa Ricci:

Rethinking Multimodal AI Models: Beyond Accuracy, Towards Trust. VISAPP 2026: 3 - Yuki Asano:

Self-Supervised Learning Is Dead, Long Live Self-Supervised Learning (in the Age of MLLMs). VISAPP 2026: 5 - Cees G. M. Snoek:

Seeing, Speaking, and Reasoning in a Visual World. VISAPP 2026: 7
Foundations & Representation Learning
- Sohambhai Joita, Tatyana Ivanovska:

GMAR++: Efficient Gradient Enhanced Attention Rollout. 13-18 - Julie Lascar

, Jules Françoise, Michèle Gouiffès, Annelies Braffort, Diandra Fabre:
PoET: Lightweight Pose Encoder Transformer for Online Sign Language Recognition. 19-28 - José Luis Huillca Mango, Raphael dos S. Evangelista, Christian Erik Condori-Mamani, Horácio Brescia Macêdo Henriques, Caio Marcus Monteiro de Oliveira, João Vitor Mendonça de Moraes, Robinson Luiz Souza Garcia, Michelle Soares Pereira Facina, Maikon Bressani, Eduardo C. Vasconcellos, Lucas Bertelli Martins, Marcos Amaral de do Almeida, Raul Queiroz Feitosa, Patrick Nigri Happ, Esteban Walter Gonzales Clua, Leandro A. F. Fernandes:

NeRF-Seg3D: Integrating Semantic Segmentation, 3D Reconstruction, and Camera Geometry for Enhanced Rust Analysis on Oil & Gas Platforms. 29-40 - Lelio Lardon, Vincente H. Guis, Éric Busvelle:

Anomaly Detection Using a Lite PatchCore for Mobile Robotic Industrial Application. 41-51 - Marcos Felipe de Menezes Mota, Hélio Pedrini, André Santanchè:

A Conformal Loss Correction Approach for Label-Noise Learning. 52-62 - Salahidine Lemaachi, Anaïs Druart, Nicolas Winckler:

Domain-Aware Diffusion for Synthetic-to-Real Data Augmentation. 63-74 - Sebastian Cygert, Damian Sójka, Tomasz Trzcinski, Bartlomiej Twardowski:

Realistic Evaluation of Test-Time Adaptation: Unsupervised Model Selection. 75-86 - José Luis Huillca Mango, Leandro A. F. Fernandes:

Multimodal Embedding for Scientific Image Caption Generation. 87-98 - Marian Avesalon Razvan, Miron Radu:

Self‑Paced Percentile Distillation for Fast and Accurate LiDAR Person Detection. VISAPP (1) 2026: 99-106 - Isabel Jiménez-Velasco, Rafael Muñoz-Salinas, Vicky Kalogeiton, Manuel J. Marín-Jiménez:

ProxiVideoFriends: Revisiting Proxemics through Temporal and Social Reasoning. 107-116 - Bruno A. Shimura, Priscila T. M. Saito, Pedro Henrique Bugatti:

Contrastive Self-Supervised Learning with Distance-Guided Positive and Negative Pair Selection. 117-125 - Brecht Deprez, Michiel Vandecappelle, Steven Lauwereins, Toon Goedemé:

Diversity by Chance: Rethinking the Need for Determinantal Point Processes in Active Learning. 126-135 - Leandro Dias Carneiro, Flavio de Barros Vidal:

Unveiling Degradations with Deep Learning Models in Face Recognition Systems. 136-147 - Thamara Leandra de Deus Melo, Rodrigo Moreira, Larissa Ferreira Rodrigues Moreira, André R. Backes:

Exploiting Test-Time Augmentation in Federated Learning for Brain Tumor MRI Classification. 148-156 - Yeonatan Mauhnoom, Gabriel Bianchin de Oliveira, Hélio Pedrini, Zanoni Dias:

From Graphs to Images: Non-Parametric PPI Context Integration for Vision-Based Protein Function Prediction. 157-166 - Laxmi Narayen Nagarajan Venkatesan, Divyam Choudhary, Sai Madhavan G, Subhajeet Lahiri, Rahulraj B. R, Rittik Panda, Dinesh Babu Jayagopi, Raj Tumuluri, Magnus Revang:

EMTA: End-to-End Multi-Task Audio-Driven Talking-Head Animation. 167-178 - Celso Luiz Silva Soares Filho

, Darlan Bruno Pontes Quintanilha, Alison Corrêa Mendes, Anselmo Cardoso de Paiva, Alexandre Pessoa, Ramsey D. Badawi, Vivek Swarnakar, Cláudio de Souza Baptista:
Automatic Classification of Whole-Body PET Scans Using Deep Features. 179-187 - Mohamad Dalal

, Thomas B. Moeslund
, Joakim Bruslund Haurum
:
Comparing Euclidean and Hyperbolic K-Means for Generalized Category Discovery. 188-198 - Marko Putak

, Thomas B. Moeslund
, Joakim Bruslund Haurum
:
How to Sample High Quality 3D Fractals for Action Recognition Pre-Training? 199-210 - Lucas Massa, Tiago F. Vieira, Allan de M. Martins, William Schwartz, Rodrigo B. de Paes, Willy Tiengo:

Disentangled Representation Learning with Variational Autoencoders for Facial Image Analysis. 211-221 - Khaled Chikh, Roberto Cavicchioli, Alessandro Capotondi

:
ShareDAB-DETR: Memory-Efficient Object Detection through CentralBank Parameter Sharing. 222-233 - Shogo Ishii, Tomoaki Yamazaki, Kengo Murata, Seiya Ito, Kouzou Ohara:

Early-Retry Regeneration Framework for Improving Object-Sufficiency in Text-to-Image Generation. 234-243 - Arno Waes, Bram Claes, Toon Goedemé:

Deep Ordinal Partial-Label Learning for Cost-Effective Small Diamond Quality Grading. 244-254 - Alessandro Passanisi, Giovanni Maria Farinella, Francesco Ragusa:

Ego-Exo Temporal Action Segmentation in Industrial Environments. 255-264 - Gustavo Pioli Resende, Renata Dos Santos Melo, Henrique Coelho Fernandes

, André Ricardo Backes:
Breast Cancer Detection Using Multi-View Infrared Images and CNN Models. 267-274 - David Faget

, Jose Luis Lisani, Miguel Colom:
Combi-CAM: A Novel Multi-Layer Approach for Explainable Image Geolocalization. 275-281 - Rafael de Camillo Masson, André Ricardo Backes:

Identification of Water Tanks and Swimming Pools as Potential Dengue Breeding Sites Using Satellite Imagery. 282-289 - Kaique Venuto Mancuzo, André Ricardo Backes:

Similarity Analysis in Source Code Using 1D Signal. 290-297 - Alexander M. Esser, Jens Dörpinghaus:

Noise-Aware Named Entity Recognition for Historical VET Documents. 298-305 - Farnaz Delirie, Afshin Dini

, Amirmasoud Molaei
, Leila Sadeghi:
ScrewCount: A Dataset and Benchmark for Exemplar Efficiency and Text-Guided Few-Shot Object Counting. 306-313 - Stuti Pathak, Rhys G. Evans

, Gunther Steenackers, Rudi Penne:
Graph-Based Point Cloud Surface Reconstruction Using B-Splines. 314-321 - Murilo Santos Regio, Thomas Trappenberg, Isabel H. Manssour:

Beyond the Black Box: A Heuristic-Based Framework for Employing Real-World Reasoning towards Explainable and Reliable Results. VISAPP (1) 2026: 322-329 - Yuta Sato, Takayoshi Yamashita, Hironobu Fujiyoshi, Tsubasa Hirakawa:

Frequency-Domain Detection of AI-Generated Images via Radial Spectrum Templates. 330-337 - Rahma Aloui, Pranav Martini, Pandu Devarakota, Apurva Gala, Shishir K. Shah:

QAC: Quality-Aware Clustering for Data-Centric Seismic Segmentation. 338-345 - Xinhao Xiang, Xiao Liu, Zizhong Li, Zhuosheng Liu, Jiawei Zhang:

AIGVE-Tool: AI-Generated Video Evaluation Toolkit with Multifaceted Benchmark. 346-357 - Yusuke Tozaki, Hisashi Miyamori:

ORDINALBENCH: A Benchmark Dataset for Diagnosing Generalization Limits in Ordinal Number Understanding of Vision-Language Models. 358-365 - Andrey Pimenov, Vera Terenteva, Sergey Muravyov, Valeria Efimova:

Recursive Memory Transformers for Scalable Analysis of Complex Vector Drawings. 366-373 - Erika-Melinda Kali, Mihai Negru:

Towards Efficient Semantic Segmentation Deep Neural Networks: Case Study of Unstructured Pruning with DeepLabV3. 374-381 - Samiha Mirza, Apurva Gala, Pandu Devarakota, Shishir Shah:

A Data Centric Framework for Seismic Data Selection Using Latent Space Distribution Analysis. 382-388 - Shrusti Porwal, Preety Singh:

Identification of Collided Vehicles in Indian Traffic Accidents Using Hierarchical Deep Learning Framework. 389-396 - Shubham Kumar Dubey

, J. V. Satyanarayana, C. Krishna Mohan:
Focal-FusionNet: A Dual-Scale Attention Network for Accurate Small Object Detection with False Positive Suppression. 397-401 - Yong Kim, Hojae Kim, Suhyun Kim, Hyeonji Kim, Huijin Choi, Yonghyun Park:

PRT: A Training-Free Planar Tracking Framework via Point Correspondence and Robust RANSAC Estimation. 402-410 - Pierre Garcia, Théo Archambault, Dominique Béréziat, Anastase Alexandre Charantonis:

GloFM: A GLORYS Flow-Matching Emulator for Spatio-Temporal Ocean Data Assimilation. 411-418 - Guilherme E. L. Pexe, Lucas A. M. Rattighieri, Leandro A. Passos, Douglas Rodrigues, Danilo S. Jodas, João P. Papa, Kelton A. P. da Costa:

FALQON-MST: A Fully Quantum Framework for Graph Optimization in Vision Systems. 419-426 - Grigorios Tsipouridis, Nikolaos Dimitriou, Efstathia Martinopoulou, Iason Karakostas, Dimitrios Tzovaras:

Optimal Camera Placement for Dynamic Scenes via Reinforcement Learning in Virtual Environments. 427-434 - Bianca Lançoni de Oliveira Garcia, Guilherme Botazzo Rozendo, Thiago Leal Pozati, Thaína Aparecida Azevedo Tosta, Marcelo Zanchetta do Nascimento, Leandro Alves Neves:

A Computational Approach for Generative Modeling and Supervised Classification: Comparative Evaluation of GAN and Diffusion Models for Histological Data Augmentation. 435-442 - Morteza Poudineh, Marc Lalonde:

DevPrompt: Deviation-Based Prompt Learning for One-Normal Shot Image Anomaly Detection. 443-450 - Qinghua Guo, Yue Sun, P. P. J. H. Langenhuizen, J. Elizabeth Bolhuis, Piter Bijma, Peter H. N. de With:

MCAMOT: Multi-Camera Assisted Multi-Object Tracking for Automated Pig Monitoring. 451-458 - Luís Felipe Rocha Pereira, João Marcello Mendes Moreira, João Dallyson Sousa de Almeida, Anselmo Cardoso de Paiva, Aristófanes Corrêa Silva, Elaine de Paula Fiod Costa:

Hybrid Ensemble of Convolutional and Transformer Models for Retinal Image Quality Evaluation. 459-466 - Joniel Bastos Barreto

, Filipe F. Caetano, Juliana M. F. da Silva, Carlos H. Q. Forster:
Frame Sequence Classification in Maritime UAV Surveillance: A Comparative Study of Temporal Deep Learning Architectures. 467-474 - Aurélie Cools, Sédrick Stassin, Sidi Ahmed Mahmoudi:

The Threshold Paradox: Why Calibrating on the Test Set Introduces Bias in Anomaly Detection. 475-482 - Yupei Guo

, Yota Yamamoto, Yukinobu Taniguchi:
Separation-Aware Downsampling for Vehicle Detection. 483-490 - Georgios Tsoumplekas, Mia Pham, Yannis Spyridis, Thomas Lagkas, Georgios Th. Papadopoulos, Panagiotis Sarigiannidis, Vasileios Argyriou:

ControlNet-Guided Diffusion for Realistic Plant Leaf Generation. 491-498 - Bin Zeng, Johannes Künzel, Anna Hilsmann, Peter Eisert:

Phys-3D: Physics-Constrained Real-Time Crowd Tracking and Counting on Railway Platforms. 499-508 - Zhiwei Guo, Qinxia Hu, Xiao Hu:

Dynamic Kernel Linear Attention Mechanism. 509-516 - Helmut Neuschmied, Werner Bailer, Martin Winter:

DINOv3 for DE-ViT: Boosting Few-Shot Object Detection with Scalable and Robust Visual Features. 517-523 - Dmitrii Drozdov, Pierre Garcia, Dominique Béréziat, Anastase Alexandre Charantonis:

Inpainting of Sparse Tracks Image Satellite Using Plug and Play and Learned Prior. 524-531 - Afifa Dahmane, Yanis Hammouche, Hadja Faiza Haned Khellaf:

Application of GANs for Segmenting Cancerous Masses in Mammograms. 532-539 - Timon Palm, Clemens Seibold, Anna Hilsmann, Peter Eisert:

Video-Based Locomotion Analysis for Fish Health Monitoring. 540-548 - René Peinl, Vincent Tischler, Patrick Schröder, Christian Groth:

SITUATE: Synthetic Object Counting Dataset for VLM Training. 549-557 - Martin Korb, Stefanie Onsori-Wechtitsch, Peter Schallauer:

When Reality Is Not Enough: Synthesizing Single Frame Defects for Improving Defect Segmentation in Film. 558-565 - Henda Boudegga, Rostom Kachouri, Yaroub Elloumi:

Lightweight and Efficient Deep Learning Architecture for Retinal Vessel Segmentation. VISAPP (1) 2026: 566-573 - João Batista Florindo:

Chaos-SSL: An Attention-Based Self-Supervised Learning Framework with Chaotic Transformation for Medical Image Classification. 574-581 - Purbaditya Bhattacharya, Erik Endlicher, Goutham Ravinaidu, Gerald Bieber, Judith Louise Pieper, Jan Langbein, Birger Puppe, Uwe Freiherr von Lukas:

Non-Contact Respiration Rate Estimation in Cattle from Overhead Videos. 582-589 - Ahmed Soulmani, Martyna Poreba, Michal Szczepanski

:
Are Superpixels the Missing Ingredient for Robust ViT Pruning? 590-597 - Pedro Victor de Abreu Fonseca, João Dallyson Sousa de Almeida, Geraldo Braz Júnior:

A PeBERT Model for Generating Keywords for Retinography Images. 598-605 - Reiji Saito, Kazuhiro Hotta:

Sin Loss for Class Imbalance and Hard Samples. 606-612 - Tomasz Michno

, Roxana-Maria Holom, Sebastian Schmalzer, Pauline Meyer-Heye
, Giulia Scampone, Elias Riegler, Matthias Hartmann, Urban Repansek, Nejc Kosir, Peter Sifrer, Katarzyna Poczeta:
Porosity Classification in High Pressure Die Casting Using Thermal Images and Sensor Data Fusion via Fuzzy Cognitive Maps. 613-622 - Alfio Spoto, Rosario Leonardi, Francesco Ragusa, Giovanni Maria Farinella:

GlovEgo-HOI: Bridging the Synthetic-to-Real Gap for Industrial Egocentric Human-Object Interaction Detection. 623-630 - Hajer Mejri, Sébastien Roy:

Beyond Accuracy: A Counterfactual Analysis of Plant Disease Classifiers. 631-641 - Romain Guesdon, Carlos Crispim-Junior, Laure Tougne Rodet:

Domain Specific Multi-Branch Network for Human Pose Estimation Inside a Car. 642-651 - Artur A. M. Oliveira, Mateus Espadoto, Roberto M. Cesar Jr., Roberto Hirata Jr.:

Graph Memory: A Structured and Interpretable Framework for Modality-Agnostic Embedding-Based Inference. 652-659 - Pietro Manganelli Conforti

, Lorenzo Papa, Irene Amerini, Paolo Russo
:
Explaining the Inexplicable: An Explainable AI Approach to Boost Knowledge Transfer. 660-670 - Stepan Kasai, Sviatoslav Stumpf, Alexey Zabashta, Valeria Efimova:

Enhanced Class-Expertise Weighted Aggregation. 671-678 - Michael B. Estrada, Boris Xavier Vintimilla, Luis E. Chuquimarca

:
A Review of Advances in Artificial Intelligence-Driven Technologies for Assessing Food Quality Using Hyperspectral and Multispectral Imaging. 679-688 - Filip Hendrichovsky

, Raphael Pickl
, Lukas Bednar
, Daniel Soukup:
CRAX: Parameter-Efficient Fine-Tuning of SAM2 for Interactive Crack Annotation. 689-700 - Alessandro Luchetti, Kenta Ito

, Dieter Schmalstieg, Denis Kalkofen, Shohei Mori:
NEF: Neural Error Fields for Follow-up Training with Fewer Rays. 701-708 - Thiago Innani Justus

, Rodrigo Minetto, Gilson A. Giraldi, Mauren Louise Sguario:
Synthetic Aerial Image Generation with Controllable Diffusion Models for Pinus Segmentation under Data Scarcity. 709-716 - Tao Wang, Hao Tang:

A Neuro-Symbolic Framework of Behaviors Recognition for Human Robot Interaction. 717-725 - Artur A. M. Oliveira, Mateus Espadoto, Roberto M. Cesar Jr., Roberto Hirata Jr.:

Efficient Video Segmentation with Differential Networks. 726-733 - Dávid Pukanec, Tibor Kubík, Michal Spanel:

From Synthetic Data to Real Restorations: Diffusion Model for Patient-Specific Dental Crown Completion. 734-742 - Petra Bevandic, Barbara Hammer:

SLAMDUNKS: A Vision-Based Approach for Uncovering Semantic Relations in Dataset Collections. 743-750

manage site settings
To protect your privacy, all features that rely on external API calls from your browser are turned off by default. You need to opt-in for them to become active. All settings here will be stored as cookies with your web browser. For more information see our F.A.Q.


Google
Google Scholar
Semantic Scholar
Internet Archive Scholar
CiteSeerX
ORCID













