Abstract is missing.
- Experimenting with Affective Computing Models in Video Interviews with Spanish-Speaking Older AdultsJosep López Camuñas, Cristina Bustos, Yanjun Zhu, Raquel Ros, Àgata Lapedriza. 1-10 [doi]
- Applying Computer Vision to Analyze Self-Injurious Behaviors in Children with Autism Spectrum DisorderAyda Eghbalian, Md Mushfiqur Azam, Katie Holloway, Leslie Neely, Kevin Desai. 11-20 [doi]
- Automatic Temporal Segmentation for Post-Stroke Rehabilitation: A Keypoint Detection and Temporal Segmentation Approach for Small DatasetsJisoo Lee, Tamim Ahmed, Thanassis Rikakis, Pavan K. Turaga. 21-29 [doi]
- SEER-ZSL: Semantic Encoder-Enhanced Representations for Generalized Zero-Shot LearningWilliam Heyden, Habib Ullah, Muhammad Salman Siddiqui, Fadi Al Machot. 30-41 [doi]
- Classification of Infant Sleep-Wake States from Natural Overnight In-Crib Sleep VideosShayda Moezzi, Michael Wan, Sai Kumar Reddy Manne, Amal Mathew, Shaotong Zhu, Bishoy Galoaa, Elaheh Hatamimajoumerd, Emma C. Grace, Cassandra B. Rowan, Emily Zimmerman, Briana J. Taylor, Marie J. Hayes, Sarah Ostadabbas. 42-51 [doi]
- UniMotion: Bridging 2D and 3D Representations for Human Motion PredictionYanjun Zhu, Chen Bai, Cheng Lu, David S. Doermann, Àgata Lapedriza. 52-62 [doi]
- CST: Character State Transformer for Object-Conditioned Human Motion PredictionKuan-Wei Tseng, Rei Kawakami, Satoshi Ikehata, Ikuro Sato. 63-72 [doi]
- Advancing Multi-Person Tracking for Autism Behavior Analysis: Challenges, Opportunities, and Future Directions in Clinical SettingsSomaieh Amraee, Eva Blanco-Mallo, Deniz Erdogmus, Aston McCullough, Matthew S. Goodwin, Sarah Ostadabbas. 73-82 [doi]
- Iris Recognition for InfantsRasel Ahmed Bhuiyan, Mateusz Trokielewicz, Piotr Maciejewicz, Sherri L. Bucher, Adam Czajka. 83-92 [doi]
- Mahalanobis k-NN: A Statistical Lens for Robust Point-Cloud RegistrationsTejas Anvekar, Shivanand Venkanna Sheshappanavar. 93-102 [doi]
- Improving Human Pose-Conditioned Generation: Fine-Tuning ControlNet Models with Reinforcement LearningJeonghwan Lee, Heywon Yun, Jimin Kim, Homa Fashandi. 103-112 [doi]
- PQD: Post-Training Quantization for Efficient Diffusion ModelsJiaojiao Ye, Zhen Wang, Linnan Jiang. 113-119 [doi]
- High-Fidelity 4× Neural Reconstruction of Real-time Path Traced ImagesZhiqiang Lao, Yu Guo, Xiyun Song, Yubin Zhou, Zongfang Lin, Heather Yu, Liang Peng. 120-129 [doi]
- LatentPS: Image Editing Using Latent Representations in Diffusion ModelsZilong Wu, Hideki Murata, Nayu Takahashi, Qiyu Wu 0001, Yoshimasa Tsuruoka. 130-139 [doi]
- Lights, Camera, Matching: The Role of Image Illumination in Fair Face RecognitionGabriella Pangelinan, Grace Bezold, Haiyu Wu, Michael C. King, Kevin W. Bowyer. 140-149 [doi]
- Quantifying Generative Stability: Mode Collapse Entropy Score for Mode Diversity EvaluationJens Duym, José Oramas, Ali Anwar 0002. 150-159 [doi]
- Similarity Trajectories: Linking Sampling Process to Artifacts in Diffusion-Generated ImagesDennis Menn, Feng Liang, Hung-Yueh Chiang, Diana Marculescu. 160-169 [doi]
- A Distortion Aware Image Quality Assessment ModelHa Thu Nguyen, Seyed Ali Amirshahi, Katrien De Moor, Mohamed-Chaker Larabi. 170-179 [doi]
- MambaTron: Efficient Cross-Modal Point Cloud Enhancement Using Aggregate Selective State Space ModelingSai Tarun Inaganti, Gennady Petrenko. 180-190 [doi]
- Diffusion Prism: Enhancing Diversity and Morphology Consistency in Mask-to-Image DiffusionHao Wang, Xiwen Chen, Ashish Bastola, Jiayou Qin, Abolfazl Razi. 191-200 [doi]
- TE-NeRF: Triplane-Enhanced Neural Radiance Field for Artifact-Free Human RenderingSadia Mubashshira, Kevin Desai. 201-210 [doi]
- IP-FaceDiff: Identity-Preserving Facial Video Editing with DiffusionTharun Anand, Aryan Garg, Kaushik Mitra. 211-221 [doi]
- SST-EM: Advanced Metrics for Evaluating Semantic, Spatial and Temporal Aspects in Video EditingVarun Biyyala, Bharat Chanderprakash Kathuria, Jialu Li 0004, Youshan Zhang. 222-231 [doi]
- Confident Pseudo-Labeled Diffusion Augmentation for Canine Cardiomegaly DetectionShiMan Zhang, Lakshmikar Reddy Polamreddy, Youshan Zhang. 232-241 [doi]
- Revealing Palimpsests with Latent Diffusion Models: A Generative Approach to Image Inpainting and Handwriting ReconstructionMahdi Jampour. 242-249 [doi]
- Unsupervised Generative Approach for Anomaly Detection to Enhance the Quality of Unseen Medical DatasetsZhemin Zhang, Bhavika Patel, Bhavik Patel, Imon Banerjee. 250-259 [doi]
- Sparse Mixture-of-Experts for Non-Uniform Noise Reduction in MRI ImagesZeyun Deng, Joseph Campbell. 260-268 [doi]
- HipyrNet: Hypernet-Guided Feature Pyramid Network for Mixed-Exposure CorrectionShaurya Singh Rathore, Aravind Shenoy, Krish Didwania, Aditya Kasliwal, Ujjwal Verma. 269-277 [doi]
- DaBiT: Depth and Blur Informed Transformer for Video Focal DeblurringCrispian Morris, Nantheera Anantrasirichai, Fan Zhang 0017, David Bull 0001. 278-288 [doi]
- LS-GAN: Human Motion Synthesis with Latent-Space GANsAvinash Amballa, Gayathri Akkinapalli, Vinitra Muralikrishnan. 289-298 [doi]
- Advancing Super-Resolution in Neural Radiance Fields via Variational Diffusion StrategiesShrey Vishen, Jatin Sarabu, Saurav Kumar, Chinmay Bharathulwar, Rithwick Lakshmanan, Vishnu Srinivas. 299-306 [doi]
- Invisibility Cloak: Hiding Anomalies in Videos via Adversarial Machine Learning AttacksHamza Karim, Yasin Yilmaz. 307-316 [doi]
- AttriVision: Advancing Generalization in Pedestrian Attribute Recognition using CLIPMehran Adibi Sedeh, Assia Benbihi, Romain Martin, Marianne Clausel, Cédric Pradalier. 317-328 [doi]
- Video-to-Text Pedestrian Monitoring (VTPM): Leveraging Large Language Models for Privacy-Preserve Pedestrian Activity Monitoring at IntersectionsAhmed S. Abdelrahman, Mohamed A. Abdel-Aty, Dongdong Wang. 329-338 [doi]
- TakuNet: An Energy-Efficient CNN for Real-Time Inference on Embedded UAV Systems in Emergency Response ScenariosDaniel Rossi, Guido Borghi, Roberto Vezzani. 339-348 [doi]
- Causal Representation-Based Domain Generalization on Gaze EstimationYounghan Kim, Kangryun Moon, Yongjun Park 0004, Yonggyu Kim. 349-358 [doi]
- Human Gaze Improves Vision Transformers by Token MaskingJacqueline Kockwelp, Daniel Beckmann, Benjamin Risse. 359-368 [doi]
- Addressing Age Bias in the Application of Appearance-Based Gaze-Tracking for Older AdultsManuela Kunz, Kathleen C. Fraser, R. Bruce Wallace, Frank Knoefel, Rafik Goubran, Sina Shafiyan, Neil Thomas. 369-377 [doi]
- VISTA: A Visual and Textual Attention Dataset for Interpreting Multimodal ModelsHarshit, Tolga Tasdizen. 378-385 [doi]
- On Segmenting Pupil Contours in Terms of Elliptical Fourier SeriesFelix O'Mahony, Patrick Furst, Michael Drews, Kai Dierkes. 386-395 [doi]
- FlatTrack: Eye-Tracking with Ultra-Thin Lensless CamerasPurvam Jain, Althaf M. Nazar, Salman Siddique Khan, Kaushik Mitra, Praneeth Chakravarthula. 396-404 [doi]
- CaLiSa-NeRF: Neural Radiance Field with Pinhole Camera Images, LiDAR point clouds and Satellite Imagery for Urban Scene RepresentationJuyeop Han, Guilherme Venturelli Cavalheiro, Josef Biberstein, Elham Alkabawi, Shahad Alqhatni, Fadwa Alaskar, Eman Bin Khunayn, Sertac Karaman. 405-413 [doi]
- Advancing Open-Set Object Detection in Remote Sensing Using Multimodal Large Language ModelNandini Saini, Ashudeep Dubey, Debasis Das 0001, Chiranjoy Chattopadhyay. 414-421 [doi]
- Adaptive Clustering for Efficient Phenotype Segmentation of UAV Hyperspectral DataCiem Cornelissen, Sam Leroux, Pieter Simoens. 422-431 [doi]
- A Zero-Shot Learning Approach for Ephemeral Gully Detection from Remote Sensing using Vision Language ModelsSeyed Mohamad Ali Tousi, Ramy Farag, Jacket Demby's, Gbenga Omotara, John A. Lory, Guilherme N. DeSouza. 432-441 [doi]
- Temporal Resilience in Geo-Localization: Adapting to the Continuous Evolution of Urban and Rural EnvironmentsFabian Deuser, Wejdene Mansour, Hao Li 0019, Konrad Habel, Martin Werner 0001, Norbert Oswald. 442-451 [doi]
- PrecipFormer: Efficient Transformer for Precipitation DownscalingRohit Kumar, Tanishq Sharma, Vedanshi Vaghela, Sanjeev K. Jha, Akshay Agarwal. 452-460 [doi]
- CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate RepresentationAlex Berian, Daniel Brignac, JhihYang Wu, Natnael Daba, Abhijit Mahalanobis. 461-469 [doi]
- Enhancing Remote Sensing Representations Through Mixed-Modality Masked AutoencodingOri Linial, George Leifman, Yochai Blau, Nadav Sherman, Yotam Gigi, Wojciech Sirko, Genady Beryozkin. 470-479 [doi]
- Mapping Refugee Camps with AI: A Benchmark Dataset and Baseline Models for Humanitarian ApplicationsAmrita Gupta, Anthony Ortiz, Simone Fobi Nsutezo, Duncan Kebut, Seema Iyer, Rahul Dodhia, Juan M. Lavista Ferres. 480-488 [doi]
- Leveraging Satellite Image Time Series for Accurate Extreme Event DetectionHeng Fang, Hossein Azizpour. 489-498 [doi]
- MD-Glow: Multi-task Despeckling Glow for SAR Image EnhancementShunsuke Takao. 499-506 [doi]
- Multiresolution Fusion and Classification of Hyperspectral and Panchromatic Remote Sensing ImagesMartina Pastorino, Gabriele Moser, Sebastiano B. Serpico, Josiane Zerubia. 507-516 [doi]
- ProMM-RS: Exploring Probabilistic Learning for Multi-Modal Remote Sensing Image RepresentationsNicolas Houdré, Diego Marcos, Dino Ienco, Laurent Wendling, Camille Kurtz, Sylvain Lobry. 517-525 [doi]
- Dfilled: Repurposing Edge-Enhancing Diffusion for Guided DSM Void FillingDaniel Panangian, Ksenia Bittner. 526-534 [doi]
- Enhancing Worldwide Image Geolocation by Ensembling Satellite-Based Ground-Level Attribute PredictorsMichael J. Bianco, David Eigen, Michael Gormish. 535-543 [doi]
- Hyperspectral Pansharpening with Transformer-Based Spectral Diffusion PriorsHongcheng Jiang, Zhiqiang Chen. 544-553 [doi]
- Direction-Guided Segmentation and Vectorisation of Curbstones from High-Resolution Ortho-ImagesMariya Jose, Stefan Auer, Jiaojiao Tian. 554-561 [doi]
- Layer Optimized Spatial Spectral Masked Autoencoder for Semantic Segmentation of Hyperspectral ImageryAaron Perez, Saurabh Prasad. 562-570 [doi]
- Pre-Training of Auto-Generated Synthetic 3D Point Cloud Segmentation for Outdoor ScenesTakayuki Shinohara. 571-580 [doi]
- FuseForm: Multimodal Transformer for Semantic SegmentationJustin McMillen, Yasin Yilmaz. 581-590 [doi]
- Robustness to Perturbations in the Frequency Domain: Neural Network Verification and Certified TrainingHarleen Hanspal, Alessandro De Palma, Alessio Lomuscio. 591-600 [doi]
- Model Weights Reflect a Continuous Space of Input Image DomainsSimen Cassiman, Marc Proesmans, Tinne Tuytelaars, Luc Van Gool. 601-610 [doi]
- Zero-Shot Hazard Identification in Autonomous Driving: A Case Study on the COOOL BenchmarkLukás Picek, Vojtech Cermák, Marek Hanzl. 611-620 [doi]
- Interpreting the Unexpected: A Multimodal Framework for Out-of-Label Hazard Detection and Explanation in Autonomous DrivingMahdi Abbariki, Maged Shoman. 621-628 [doi]
- SGNetPose+: Stepwise Goal-Driven Networks with Pose Information for Trajectory Prediction in Autonomous DrivingAkshat Ghiya, Ali K. AlShami, Jugal Kalita. 629-637 [doi]
- Open-World Hazard Detection and Captioning for Autonomous Driving with a Unified Multimodal PipelineParisa Hatami, Maged Shoman, Mina Sartipi. 638-646 [doi]
- DiffFake: Exposing Deepfakes Using Differential Anomaly DetectionSotirios Stamnas, Victor Sanchez. 647-657 [doi]
- Improving the Perturbation-Based Explanation of Deepfake Detectors Through the Use of Adversarially-Generated SamplesKonstantinos Tsigos, Evlampios Apostolidis, Vasileios Mezaris. 658-667 [doi]
- IDTrust: Deep Identity Document Quality Detection with Bandpass FilteringMusab Al-Ghadi, Joris Voerman, Mickaël Coustaty, Olivier Lessard, Nicolas Sidere. 668-675 [doi]
- HFMF: Hierarchical Fusion Meets Multi-Stream Models for Deepfake DetectionAnant Mehta, Bryant McArthur, Nagarjuna Kolloju, Zhengzhong Tu. 676-685 [doi]
- GrDT: Towards Robust Deepfake Detection Using Geometric Representation Distribution and TextureHongyang Xie, Hongyang He, Boyang Fu, Victor Sanchez. 686-696 [doi]
- FoundPAD: Foundation Models Reloaded for Face Presentation Attack DetectionGuray Ozgur, Eduarda Caldeira, Tahar Chettaoui, Fadi Boutros, Raghavendra Ramachandra, Naser Damer. 697-707 [doi]
- Disharmony: Forensics Using Reverse Lighting HarmonizationPhilip Wootaek Shin, Jack Sampson, Vijaykrishnan Narayanan, Andres Marquez, Mahantesh Halappanavar. 708-717 [doi]
- FX-MAD: Frequency-Domain Explainability and Explainability-Driven Unsupervised Detection of Face Morphing AttacksMarco Huber, Pedro C. Neto, Ana Filipa Sequeira, Naser Damer. 718-728 [doi]
- Enhancing Synthetic Generated-Images Detection through Post-Hoc CalibrationGiovanna Maria Dimitri, Benedetta Tondi, Mauro Barni. 729-736 [doi]
- Zero-Shot Warning Generation for Misinformative Multimodal ContentGiovanni Pio Delvecchio, Huy H. Nguyen, Isao Echizen. 737-746 [doi]
- Enhancing Ground-to-Aerial Image Matching for Visual Misinformation Detection Using Semantic SegmentationEmanuele Mule, Matteo Pannacci, Ali Ghasemi Goudarzi, Francesco Pro, Lorenzo Papa, Luca Maiano, Irene Amerini. 747-755 [doi]
- Zero-Training Fraud Detection in a Large Messaging Platform?Stephane F. Schwarz, Paulo Fonseca, Anderson Rocha 0001. 756-764 [doi]
- SSTAR: Skeleton-Based Spatio-Temporal Action Recognition for Intelligent Video Surveillance and Suicide Prevention in Metro StationsSafwen Naimi, Wassim Bouachir, Guillaume-Alexandre Bilodeau, Brian L. Mishara. 765-775 [doi]
- YOLO11-JDE: Fast and Accurate Multi-Object Tracking with Self-Supervised Re-IDIñaki Erregue, Kamal Nasrollahi, Sergio Escalera. 776-785 [doi]
- Evaluation of Spatio-Temporal Small Object Detection in Real-World Adverse Weather ConditionsMichel van Lier, Martin van Leeuwen, Bastian Van Manen, Leo Kampmeijer, Nicolas Boehrer. 786-797 [doi]
- Fall Detection: Leveraging Depth Information in Bayesian NetworksMarc Oliu, Rohat Bozyil, Mia Sandra Nicole Siemon, Alejandro Martinez-Senent, Sergio Escalera, Thomas B. Moeslund, Kamal Nasrollahi. 798-805 [doi]
- Interpreting Face Recognition Templates Using Natural Language DescriptionsAnastasija Manojlovska, Raghavendra Ramachandra, Georgios Spathoulas, Vitomir Struc, Klemen Grm. 806-815 [doi]
- MCTR: Multi Camera Tracking TransformerAlexandru Niculescu-Mizil, Deep Patel, Iain Melvin. 816-826 [doi]
- Joint Audio-Visual Idling Vehicle Detection with Streamlined Input DependenciesXiwen Li, Rehman Mohammed, Tristalee Mangin, Surojit Saha, Kerry E. Kelly, Ross T. Whitaker, Tolga Tasdizen. 827-836 [doi]
- Simultaneous Multi-Object Multi-Camera Trajectory Forecasting (SMO-MCTF)Amey Noolkar, Victor Sanchez. 837-843 [doi]
- B-FPGM: Lightweight Face Detection via Bayesian-Optimized Soft FPGM PruningNikolaos Kaparinos, Vasileios Mezaris. 844-853 [doi]
- BeSplat: Gaussian Splatting from a Single Blurry Image and Event StreamGopi Raju Matta, Reddypalli Trisha, Kaushik Mitra. 854-864 [doi]
- Simple Transformer with Single Leaky Neuron for Event VisionHimanshu Kumar, Aniket Konkar. 865-871 [doi]
- Combined Physics and Event Camera Simulator for Slip DetectionThilo Reinold, Suman Ghosh, Guillermo Gallego 0002. 872-880 [doi]
- Continuous Histogram for Event-Based Vision Camera SystemsJonghun Park, MunHo Hong. 881-889 [doi]
- Language-Driven Active Learning for Diverse Open-Set 3D Object DetectionRoss Greer, Bjørk Antoniussen, Andreas Møgelmose, Mohan M. Trivedi. 890-898 [doi]
- SenseRAG: Constructing Environmental Knowledge Bases with Proactive Querying for LLM-Based Autonomous DrivingXuewen Luo, Fan Ding, Fengze Yang, Yang Zhou, Junnyong Loo, Hwa Hui Tew, Chenxi Liu. 899-906 [doi]
- Glimpse of MCQ Based VQA in Road & Traffic ScenariosAthira Krishnan R, Sumukha BG, Ambarish Parthasarathy. 907-910 [doi]
- OpenEMMA: Open-Source Multimodal Model for End-to-End Autonomous DrivingShuo Xing, Chengyuan Qian, Yuping Wang, Hongyuan Hua, Kexin Tian, Yang Zhou 0019, Zhengzhong Tu. 911-919 [doi]
- Position: Prospective of Autonomous Driving - Multimodal LLMs, World Models, Embodied Intelligence, AI Alignment, and MambaYunsheng Ma, Wenqian Ye, Can Cui, Haiming Zhang 0001, Shuo Xing, Fucai Ke, Jinhong Wang, Chenglin Miao, Jintai Chen, Hamid Rezatofighi, Zhen Li 0026, Guangtao Zheng, Chao Zheng, Tianjiao He, Manmohan Chandraker, Burhaneddin Yaman, Xin Ye, Hang Zhao, Xu Cao. 920-936 [doi]
- Evaluating Multimodal Vision-Language Model Prompting Strategies for Visual Question Answering in Road Scene UnderstandingAryan Keskar, Srinivasa Perisetla, Ross Greer. 937-946 [doi]
- Scenario Understanding of Traffic Scenes Through Large Visual Language ModelsEsteban Rivera, Jannik Lübberstedt, Nico Uhlemann, Markus Lienkamp. 947-955 [doi]
- Enhancing Weakly-Supervised Object Detection on Static Images Through (Hallucinated) MotionCagri Gungor, Adriana Kovashka. 956-960 [doi]
- Query3D: LLM-Powered Open-Vocabulary Scene Segmentation with Language Embedded 3D GaussiansAmirhosein Chahe, LiFeng Zhou. 961-970 [doi]
- ScVLM: Enhancing Vision-Language Model for Safety-Critical Event UnderstandingLiang Shi, Boyu Jiang, Tong Zeng, Feng Guo. 971-981 [doi]
- VLMine: Long-Tail Data Mining with Vision Language ModelsMao Ye 0006, Gregory P. Meyer, Zaiwei Zhang, Dennis Park, Siva Karthik Mustikovela, Yuning Chai, Eric M. Wolff. 982-992 [doi]
- Detecting Contextual Anomalies by Discovering Consistent Spatial RegionsZhengye Yang, Richard J. Radke. 993-1002 [doi]
- ComplexVAD: Detecting Interaction Anomalies in VideoFurkan Mumcu, Michael J. Jones 0001, Yasin Yilmaz, Anoop Cherian. 1003-1012 [doi]
- ML-JET: A Benchmark Dataset for Classifying Heavy Ion CollisionsHaydar Mehryar, Chengzhi Mao, Loren Schwiebert. 1013-1022 [doi]
- AnoFPDM: Anomaly Detection with Forward Process of Diffusion Models for BrainMRIYiming Che, Fazle Rafsani, Jay Shah, Md Mahfuzur Rahman Siddiquee, Teresa Wu. 1023-1032 [doi]
- Exploring Pose-Based Anomaly Detection for Retail Security: A Real-World Shoplifting Dataset and BenchmarkNarges Rashvand, Ghazal Alinezhad Noghre, Armin Danesh Pazho, Shanle Yao, Hamed Tabkhi. 1033-1041 [doi]
- PCAD: A Real-World Dataset for 6D Pose Industrial Anomaly DetectionRobert F. Maack, Lars Thun, Thomas Liang, Hasan Tercan, Tobias Meisen. 1042-1051 [doi]
- AAT-DA: Accident Anticipation Transformer with Driver AttentionYuto Kumamoto, Kento Ohtani, Daiki Suzuki, Minori Yamataka, Kazuya Takeda. 1052-1061 [doi]
- Snapshot: Towards Application-Centered Models for Pedestrian Trajectory Prediction in Urban Traffic EnvironmentsNico Uhlemann, Yipeng Zhou, Tobias Simeon Mohr, Markus Lienkamp. 1062-1072 [doi]
- "What's Happening"- A Human-centered Multimodal Interpreter Explaining the Actions of Autonomous VehiclesXuewen Luo, Fan Ding, Ruiqi Chen, Rishikesh Panda, Junnyong Loo, Shuyun Zhang. 1073-1080 [doi]
- Deep Learning-based rPPG Models Towards Automotive Applications: A Benchmark StudyTayssir Bouraffa, Dimitrios Koutsakis, Salvija Zelvyte. 1081-1090 [doi]
- Location Generalizability of Image-Based Air Quality ModelsEleanor Byler, Christian Svinth, Kirsten Chojnicki. 1091-1100 [doi]
- FineAir: Finest-grained Airplanes in High-resolution Satellite ImagesMurat Osswald, Louis Niederlohner, Sascha Köjer, Tobias Ziedorn, Valerio Gulli, Michael Mommert, Helmut Mayer 0001. 1101-1109 [doi]
- Adaptive Structure-Aware Connectivity-Preserving Loss for Improved Road Segmentation in Remote Sensing ImagesSara Shojaei, Trevor Bohl, Kannappan Palaniappan, Filiz Bunyak. 1120-1128 [doi]
- Interactive Rotated Object Detection for Novel Class Detection in Remotely Sensed ImageryMarvin Burges, Philipe Ambrozio Dias, Carson Woody, Sarah Walters, Dalton D. Lunga. 1129-1137 [doi]
- EarthView: A Large Scale Remote Sensing Dataset for Self-SupervisionDiego A. Velázquez, Pau Rodríguez López, Sergio Alonso, Josep M. Gonfaus, Jordi Gonzàlez 0001, Gerardo Richarte, Javier Marin, Yoshua Bengio, Alexandre Lacoste. 1138-1147 [doi]
- Semantic Neural Radiance Fields for Multi-Date Satellite DataValentin Wagner, Sebastian Bullinger, Christoph Bodensteiner, Michael Arens. 1148-1156 [doi]
- SkipClick: Combining Quick Responses and Low-Level Features for Interactive Segmentation in Winter Sports ContextsRobin Schön, Julian Lorenz, Daniel Kienzle, Rainer Lienhart. 1157-1166 [doi]
- Gate-Shift-Pose: Enhancing Action Recognition in Sports with Skeleton InformationEdoardo Bianchi, Oswald Lanz. 1167-1174 [doi]
- Towards Long-Term Player Tracking with Graph Hierarchies and Domain-Specific FeaturesMaria Koshkina, James H. Elder. 1175-1185 [doi]
- CLaP - Contrast, Label, Predict: A Quest for Cheaper Labeling in 3D Human Pose EstimationDavide Cavicchini, Alessia Pivotto, Sofia Lorengo, Andrea Rosani, Nicola Garau. 1186-1194 [doi]
- Mixed-Precision is All You Need for Efficient Document Image ClassificationTushar Shinde, Shivam Bhardwaj. 1195-1203 [doi]
- Improving the Identification of Layers in 3D Images of Ancient Papyrus Using Artificial Neural NetworksNicolas Klenert, Finn Schwoerer, Noushin Hajarolasvadi, Siloé Bournez, Tobias Arlt, Heinz-Eberhard Mahnke, Verena Lepper, Daniel Baum. 1204-1212 [doi]
- DocSum: Domain-Adaptive Pre-training for Document Abstractive SummarizationPhan Phuong Mai Chau, Souhail Bakkali, Antoine Doucet. 1213-1222 [doi]
- Multi-Modal Large Language Model Driven Augmented Reality Situated Visualization: The Case of Wine RecognitionVincenzo Armandi, Andrea Loretti, Lorenzo Stacchio, Pasquale Cascarano, Gustavo Marfia. 1223-1232 [doi]
- Low-Rank Adaptation vs. Fine-Tuning for Handwritten Text RecognitionLukas Hüttner, Martin Mayr, Thomas Gorges, Fei Wu 0025, Mathias Seuret, Andreas K. Maier, Vincent Christlein. 1233-1242 [doi]
- RAPTOR: Refined Approach for Product Table Object RecognitionEliott Thomas, Mickaël Coustaty, Aurélie Joseph, Gaspar Deloin, Elodie Carel, Vincent Poulaind'ecy, Jean-Marc Ogier. 1243-1252 [doi]
- A Comparative Analysis of OCR Models on Diverse Datasets: Insights from Memes and Hiertext DatasetIknoor Singh, Miguel Colom, Kalina Bontcheva. 1253-1263 [doi]
- Offline Signature Verification in the Banking DomainValentina Arrigoni. 1264-1273 [doi]
- WTPose: Waterfall Transformer for Multi-person Pose EstimationNavin Ranjan, Bruno Artacho, Andreas E. Savakis. 1274-1281 [doi]
- What Matters When Building Vision Language Models for Product Image Analysis?Ameni Trabelsi, Maria Zontak, Yiming Qian, Brian Jackson, Suleiman Ali Khan, Umit Batur. 1282-1291 [doi]
- SIGN-GAIL: Rewarding Online Signature Generation for Digital ImitationAnurag Pandey 0004, Arnav Bhavsar, Aditya Nigam, Divya Acharya, Basu Verma, Balaji Rao K. 1292-1301 [doi]
- Exploring Correlated Facial Attributes in Text-to-Image Models: Unintended Consequences in Synthetic Face GenerationSander De Coninck, Sam Leroux, Pieter Simoens. 1302-1311 [doi]
- On the Generalisation Capability of Local Surface Frames in Detecting Diffusion-Based Facial ImagesAndrea Ciamarra, Roberto Caldelli, Alberto Del Bimbo. 1312-1321 [doi]
- Generating Realistic Forehead-Creases for User Verification via Conditioned Piecewise Polynomial CurvesAbhishek Tandon, Geetanjali Sharma, Gaurav Jaswal, Aditya Nigam, Raghavendra Ramachandra. 1322-1330 [doi]
- Face-swapping Based Data Augmentation for ID Document and Selfie Face VerificationElmokhtar Mohamed Moussa, Ioannis Sarridis, Emmanouil Krasanakis, Nathan Ramoly, Symeon Papadopoulos, Ahmad-Montaser Awal, Lara Younes. 1331-1338 [doi]
- Unified Face Matching and Physical-Digital Spoofing Attack DetectionArun Kunwar, Ajita Rattani. 1339-1349 [doi]
- Latent Diffusion Shield - Mitigating Malicious Use of Diffusion Models Through Latent Space Adversarial PerturbationsHuy Phan, Boshi Huang, Ayush Jaiswal, Ekraam Sabir, Prateek Singhal, Bo Yuan 0001. 1350-1358 [doi]
- Parallel Prints: Generating Realistic Cancelable Fingerprint TemplatesRishabh Shukla, Harkeerat Kaur, Isao Echizen. 1359-1368 [doi]
- TextureCrop: Enhancing Synthetic Image Detection Through Texture-Based CroppingDespina Konstantinidou, Christos Koutlis, Symeon Papadopoulos. 1369-1378 [doi]
- Digi2Real: Bridging the Realism Gap in Synthetic Data Face Recognition via Foundation ModelsAnjith George, Sébastien Marcel. 1379-1388 [doi]
- Fashionability-Enhancing Outfit Image Editing with Conditional Diffusion ModelsQice Qin, Yuki Hirakawa, Ryotaro Shimizu, Takuya Furusawa, Edgar Simo-Serra. 1389-1399 [doi]
- Segment Anything in Light Fields for Real-Time Applications via Constrained PromptingNikolai Goncharov, Donald G. Dansereau. 1400-1406 [doi]
- M-GAID: A Real-World Dataset for Ghosting Artifact Detection and Removal in Mobile ImagingMuneeb Ahmed Khan, Hyungsub Kim, Jiho Eum, Yihyun Myung, Yujin Choi, Heemin Park. 1407-1416 [doi]
- Automatic Fish Age Prediction Using Deep Machine Learning: Combining Otolith Image, FT-NIR Spectra and Metadata FeaturesAotian Zheng, Jenq-Neng Hwang, Yudong Liu, Qiancheng Li, Beverly Barnett, Farron Wallace, Irina Benson, Thomas Helser. 1417-1424 [doi]
- Marine Event Vision: Harnessing Event Cameras for Robust Object Detection in Marine ScenariosNenyi Kweku Nkensen Dadson, Corina Barbalata. 1425-1434 [doi]
- Underwater Image Enhancement and Object Detection: Are Poor Object Detection Results On Enhanced Images Due to Missing Human Labels?Evan Lucas, Ali Awad, Anthony Geglio, Ashraf Saleem, Shadi Moradi, Timothy C. Havens, Angus Galloway, Sidike Paheding. 1435-1440 [doi]
- Camera-based Intruder Detection and Monitoring of Ship Crew Work HoursMd Mahmuddun Nabi Murad, Bora San Turgut, Awwab Ahmed, Gokhan Camliyurt, Yasin Yilmaz. 1441-1449 [doi]
- Vessel Registration Number Detection and Recognition SystemMatej Fabijanic, Maja Magdalenic, Juraj Obradovic, Nadir Kapetanovic, Fausto Ferreira, Nikola Miskovic. 1450-1456 [doi]
- rd Workshop on Maritime Computer Vision (MaCVi) 2025: Challenge ResultsBenjamin Kiefer, Lojze Zust, Jon Muhovic, Matej Kristan, Janez Pers, Matija Tersek, Uma Mudenagudi, Chaitra Desai, Arnold Wiliem, Marten Kreis, Nikhil Akalwadi, Yitong Quan, Zhiqiang Zhong, Zhe Zhang, Sujie Liu, Xuran Chen, Yang Yang, Matej Fabijanic, Fausto Ferreira, Seongju Lee, Junseok Lee, Kyoobin Lee, Shanliang Yao, Runwei Guan, Xiaoyu Huang, Yi Ni, Himanshu Kumar, Yuan Feng, Yi-Ching Cheng, Tzu-Yu Lin, Chia-Ming Lee, Chih-Chung Hsu, Jannik Sheikh, Andreas Michel, Wolfgang Gross, Martin Weinmann, Josip Saric, Yipeng Lin, Xiang Yang, Nan Jiang, Yutang Lu, Fei Feng, Ali Awad, Evan Lucas, Ashraf Saleem, Ching-Heng Cheng, Yu-Fan Lin, Tzu-Yu Lin, Chih-Chung Hsu. 1457-1484 [doi]
- A Framework for Imbalanced SAR Ship Classification: Curriculum Learning, Weighted Loss Functions, and a Novel Evaluation MetricCh Muhammad Awais, Marco Reggiannini, Davide Moroni. 1485-1493 [doi]
- MTReD: 3D Reconstruction Dataset for Fly-Over Videos of Maritime DomainRui Yi Yong, Samuel Picosson, Arnold Wiliem. 1494-1502 [doi]
- In-domain Self-supervised Learning for Plankton Image Classification on a BudgetMassimiliano Ciranni, Ani Gjergji, Andrea Maracani, Vittorio Murino, Vito Paolo Pastore. 1503-1512 [doi]
- AutoFish: Dataset and Benchmark for Fine-Grained Analysis of FishStefan Hein Bengtson, Daniel Lehotský, Vasiliki Ismiroglou, Niels Madsen, Thomas B. Moeslund, Malte Pedersen. 1513-1522 [doi]
- Navigating Coreset Selection and Model Compression for Efficient Maritime Image ClassificationTushar Shinde, Avinash Kumar Sharma, Shivam Bhardwaj, Ahmed Silima Vuai. 1523-1531 [doi]
- FalconEye: Efficient Centroid-Based Object Detection for Maritime High Altitude UAV Images on Embedded DevicesRohan Sawahn, Maximilian Schall. 1532-1543 [doi]
- Extracting Local Information from Global Representations for Interpretable Deepfake DetectionElahe Soltandoost, Richard Plesh, Stephanie Schuckers, Peter Peer, Vitomir Struc. 1544-1554 [doi]
- Transferable Adversarial Attacks on Audio Deepfake DetectionMuhammad Umar Farooq, Awais Khan 0007, Kutub Uddin, Khalid Mahmood Malik. 1555-1564 [doi]
- MADation: Face Morphing Attack Detection with Foundation ModelsEduarda Caldeira, Guray Ozgur, Tahar Chettaoui, Marija Ivanovska, Peter Peer, Fadi Boutros, Vitomir Struc, Naser Damer. 1565-1575 [doi]
- Wavelet-Driven Generalizable Framework for Deepfake Face Forgery DetectionLalith Bharadwaj Baru, Rohit Boddeda, Shilhora Akshay Patel, Sai Mohan Gajapaka. 1576-1584 [doi]
- Model Compression Meets Resolution Scaling for Efficient Remote Sensing ClassificationTushar Shinde. 1576-1584 [doi]
- Metric for Evaluating Performance of Reference-Free Demorphing MethodsNitish Shukla, Arun Ross. 1585-1591 [doi]
- Face Detection and Recognition Under Real-World Scenarios - Dealing with Deepfake Incidents and Malicious Data DistortionsEwelina Bartuzi-Trokielewicz, Alicja Martinek, Adrian Kordas. 1592-1601 [doi]
- Exploring ChatGPT for Face Presentation Attack Detection in Zero and Few-Shot in-Context LearningAlain Komaty, Hatef Otroshi-Shahreza, Anjith George, Sébastien Marcel. 1602-1611 [doi]