Abstract is missing.
- Out-of-Distribution Sample Selection Generated by Diffusion Model toward Model GeneralizationKaede Hayakawa, Keisuke Maeda, Ren Togo, Takahiro Ogawa 0001, Miki Haseyama. 1-6 [doi]
- CAG: Context-Conditional 2D Affordance GenerationGeonkuk Kim, Tae-Min Choi, Shinsuk Park, Juyoun Park. 1-6 [doi]
- Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-ExplanationNaoto Tanji, Toshihiko Yamasaki. 1-6 [doi]
- Judging From Support-Set: A New Way To Utilize Few-Shot Segmentation For Segmentation Refinement ProcessSeonghyeon Moon, Qingze Tony Liu, Haein Kong, Muhammad Haris Khan. 1-6 [doi]
- Boosting Text-To-Image Person Re-Identification With Generative Hard NegativeWei Yue, Hua Yang, Renjie Pan. 7-12 [doi]
- Towards Controllable Real Image Denoising With Camera ParametersYoungjin Oh, Junhyeong Kwon, Keuntek Lee, Nam Ik Cho. 13-18 [doi]
- DISCO: A Diffusion Model For Spatial Transcriptomics Data CompletionZiheng Duan, Xi Li, Zhuoyang Zhang, James Song, Jing Zhang 0062. 19-24 [doi]
- Frozen Network Few-Shot Object DetectionKoshiro Nagano, Fumiaki Sato, Ryo Hachiuma, Kazuki Tsutsukawa, Taiki Sekii. 25-30 [doi]
- ViTA-PAR: Visual And Textual Attribute Alignment With Attribute Prompting For Pedestrian Attribute RecognitionMinjeong Park, Hongbeen Park, Jinkyu Kim. 31-36 [doi]
- Rollout-Guided Token Pruning for Efficient Video UnderstandingYonatan Dinai, Ishay Goldin, Avraham Raviv, Niv Zehngut. 37-42 [doi]
- Spectral-aware Global Fusion for RGB-Thermal Semantic SegmentationCe Zhang 0009, Zifu Wan, Simon Stepputtis, Katia Sycara, Yaqi Xie 0001. 43-48 [doi]
- Plug-and-Play Priors as a Score-Based MethodChicago Y. Park, Yuyang Hu, Michael T. McCann, Cristina Garcia-Cardona, Brendt Wohlberg, Ulugbek S. Kamilov. 49-54 [doi]
- Enhancing Visual Re-Ranking Through Denoising Nearest Neighbor Graph via Continuous CRFJaeyoon Kim, Yoonki Cho, Taeyoung Kim, Sung-Eui Yoon. 55-60 [doi]
- Video Individual Counting with Implicit One-to-Many MatchingXuhui Zhu, Jing Xu, Bingjie Wang, Huikang Dai, Hao Lu. 61-66 [doi]
- Spatial-Spectral Consistency: A Semi-Supervised Approach for Multispectral Scene ClassificationJin Li, Huajie Wang, Zhizhuo Jiang, Yu Liu. 67-72 [doi]
- MFB-SAC: A Multi-Scale Frequency and Boundary-Enhanced SAM for Cell SegmentationXutao Sun, Xiaolu Xu, Junwen Liu, Yonggong Ren. 73-78 [doi]
- MedKI: Knowledge Dual Injections for Medical Visual Question AnsweringHongyi Ren, Weiran Chen 0001, Chunping Liu, Yi Ji 0001, Ying Li 0065. 79-84 [doi]
- Adapting Foundation Features via Cross-View Contrastive Learning for Unseen Object Pose EstimationJaeguk Kim, Nam Ik Cho. 85-90 [doi]
- Towards Effective and Robust Unlearnable Examples Against Object DetectionChenyu Yi, Ruohan Meng, Haohang Peng, Bingquan Shen, Alex C. Kot. 91-96 [doi]
- GTA-Crime: A Synthetic Dataset and Generation Framework for Fatal Violence Detection with Adversarial Snippet-Level Domain AdaptationSeongho Kim, Sejong Ryu, Hyoukjun You, Je Hyeong Hong. 97-102 [doi]
- Improving Open-World Class-Agnostic Object Detectors via Feature Distillation with Student-Aware AdaptationKengo Murata, Takuma Yamamoto, Yuya Obinata, Osafumi Nakayama. 103-108 [doi]
- Objective, Absolute and Hue-Aware Metrics for Intrinsic Image Decomposition on Real-World Scenes: A Proof of ConceptShogo Sato, Masaru Tsuchida, Mariko Yamaguchi, Takuhiro Kaneko, Kazuhiko Murasaki, Taiga Yoshida, Ryuichi Tanida. 109-114 [doi]
- Multimodal Re-Ranking for Heterogeneous Face Re-IdentificationHui Hu, Wenqin Song, Jiawei Zhang 0002, Zhen Han 0002, Yunfeng Xue, Xihao Wang, Zhongyuan Wang 0001. 115-120 [doi]
- Semi-Supervised Infrared Meibomian Gland Segmentation with Intra-Patient Registration and Feature SupervisionYushun Huang, Kunfeng Lai, Taichen Lai, Jiawen Lin, Li Li. 121-126 [doi]
- Gop-Level Adaptive Resampling with CNN-based Super ResolutionRenjie Chang, Liqiang Wang, Xiaozhong Xu, Shan Liu 0001. 127-132 [doi]
- Cluster Contrast for Unsupervised Visual Representation LearningNikolaos Giakoumoglou, Tania Stathaki. 133-138 [doi]
- FMG-Det: Foundation Model Guided Robust Object DetectionDarryl Hannan, Timothy Doster, Henry Kvinge, Adam Attarian, Yijing Watkins. 139-144 [doi]
- Metalwork: A Synthetic Dataset and Baseline for Stereo Matching of Metal WorkpiecesShiying Li, Binghui Zuo, Yangang Wang 0001. 145-150 [doi]
- Adaptive High-Frequency Preprocessing for Video CodingYingxue Pang, Shijie Zhao, Junlin Li, Li Zhang. 151-156 [doi]
- Compressing Human Body Video with Interactive Semantics: A Generative ApproachBolin Chen, Shanzhi Yin, Hanwei Zhu, Lingyu Zhu 0006, Zihan Zhang, Jie Chen 0006, Ru-Ling Liao, Shiqi Wang 0001, Yan Ye 0003. 157-162 [doi]
- Adaptive Multimodal Fusion via Attention-Guided Feature Selection for Histopathology Image ClassificationJiaxin Lei, Kaihao He, Xiaoyan Sun 0006, Zhenming Yuan, Jian Zhang 0026. 163-168 [doi]
- MMP-2k: A Benchmark Multi-Labeled Macro Photography Image Quality Assessment DatabaseJiashuo Chang, Zhengyi Li, Jianxun Lou, Zhen Qiu 0001, Hanhe Lin. 169-174 [doi]
- A Novel Method and Dataset for Depth-Guided Image Deblurring From Smartphone LidarAntonio Montanaro, Diego Valsesia. 175-180 [doi]
- A Benchmark and Evaluation for Real-World Out-of-Distribution Detection Using Vision-Language ModelsShiho Noda, Atsuyuki Miyai, Qing Yu 0013, Go Irie, Kiyoharu Aizawa. 181-186 [doi]
- SF-VQA: Saliency Fragments No-Reference Video Quality AssessmentNamUk Kim, Cheul-Hee Hahm, Wook-Hyung Kim, Ilhyun Cho, Sojeong Park. 187-192 [doi]
- Fast Bounding Box HierarchyZhe Zhu, Sumit Jha, Joonsoo Kim, Arshita Gupta, Tien C. Bau. 193-198 [doi]
- Estimating Virtual Camera FOV to Reduce Perspective Shape Distortion in 2D-to-3D Face ReconstructionPeizhi Yan, Rabab Ward, Qiang Tang 0002, Shan Du 0001. 199-204 [doi]
- No-Reference Textured Mesh Quality Assessment Using Graph-Based FeaturesRyosuke Watanabe, Hanif Fermanda Putra, Tomoaki Konno, Sei Naito. 205-210 [doi]
- DBF-Net: A Dual-Branch Network with Feature Fusion for Ultrasound Image SegmentationGuoping Xu, Xiaming Wu, Wentao Liao, Xinglong Wu, Qing Huang, Chang Li 0001. 211-216 [doi]
- SDFCNet: A Spatial-Domain and Frequency-Domain Collaborative Network for Building Extraction in High-Resolution Remote Sensing ImagesXiansheng Huang, Jiawen Lin, Cairen Jian, Qin Wang, Qian Weng. 223-228 [doi]
- Quanta DiffusionPrateek Chennuri, Dongdong Fu, Stanley H. Chan. 229-234 [doi]
- Robust Multimodal Representation Learning with Information Bottleneck and Balanced Fusion for Alzheimers Disease ClassificationYulan Dai, Beiji Zou 0001, Xiaoyan Kui, Zexin Ji, Chengzhang Zhu. 235-240 [doi]
- New Multi-Source Distributed Transfer Learning FrameworkLinqing Huang, Jing Zhu, Yumei Hu, Shilin Wang, Gongshen Liu, Jinfu Fan. 241-246 [doi]
- A Unified Transformer-Based Framework with Pretraining for Whole Body Grasping Motion GenerationEdward Effendy, Kuan-Wei Tseng, Rei Kawakami. 247-252 [doi]
- Mamba-SF: Monocular Scene Flow Learning with State Space ModelsYiming Chen, Xuezhi Xiang, Xianye Ben, Insha Hassan, Mingliang Zhai, Lei Zhang 0093, Xiantong Zhen. 253-258 [doi]
- Guided Detail Filter for AVMKhanh Quoc Dinh, Yangwoo Kim, Madhukar Budagavi, Rajan Joshi, Kwang-Pyo Choi. 259-264 [doi]
- Multi-Level and Multi-Modal Action AnticipationSeulgi Kim, Ghazal Kaviani, Mohit Prabhushankar, Ghassan Alregib. 265-270 [doi]
- Deformable Spherical Geometry Transformer For Panoramic Semantic SegmentationBoyang Lan, Li Yang 0014, Mai Xu, Lai Jiang 0004, Yufeng Wang 0004. 271-276 [doi]
- Oriented Object Detection Based On Composite Trigonometric Function CoderJing Hu 0005, Jiawei Liang, Minghua Zhao, Shuangli Du, Peng Li 0036. 277-282 [doi]
- Coding-Information Based Improvement For In-Loop Filters Beyond VVCWenbin Yin, Kai Zhang 0007, Hongbin Liu 0004, Li Zhang. 283-288 [doi]
- DisenEmo: Learning disentangled emotional representation from facial motion for 3D talking head generationZiang Chen, Tianhua Qi, Cheng Lu 0005, Wenming Zheng. 289-294 [doi]
- Enact: Entropy-Based Clustering of Attention Input for Reducing the Computational Needs of Object Detection TransformersGiorgos Savathrakis, Antonis A. Argyros. 295-300 [doi]
- DMSO: A Dynamic Momentum-Smoothing Optimizer for Learned Image CompressionChao Li 0071, Chuanmin Jia, Fanyang Meng, Hao Qi, Siwei Ma 0001, Yongsheng Liang 0001. 307-312 [doi]
- CLIP-FSQAE: Clip-Guided Finite Scalar Quantized Autoencoder for Few-Shot Anomaly DetectionShih Chih Lin, Shang-Hong Lai. 313-318 [doi]
- Enhancing Autonomous Driving Perception Under Complex Weather Conditions Through Cyclegan-Based Driving Scene GenerationLitong Liu, Gaoxuan Li, Yaya Huang, Yixuan Dong, Chee-Ming Ting, Junn Yong Loo. 319-324 [doi]
- Image Motion Blur Removal In The Temporal Dimension With Video Diffusion ModelsWang Pang, Zhihao Zhan, Xiang Zhu, Yechao Bai. 325-330 [doi]
- CWC-DNERF: Compact Dynamic Neural Radiance Field VIA Discrete Wavelet Transform And Learnable CodebooksYaojian Xu, Rui Li, Qiudan Zhang, Longhao Zou, Qiong Liu, Xu Wang 0006. 331-336 [doi]
- Detecting And Mitigating Incoherent Input Of Latent Diffusion ModelsChristopher B. Kuhn, Bogaç Ünver, Diego Vera, Christoph Burgmair, Tamay Aykut. 337-342 [doi]
- Variable Rate Learned Wavelet Video Coding Using Temporal Layer AdaptivityAnna Meyer, André Kaup. 343-348 [doi]
- Compact Latent Representation for Image Compression (CLRIC)Ayman A. Ameen, Thomas Richter 0005, André Kaup. 349-354 [doi]
- Efficient Text-to-Image Generation: An Adaptive Step Schedule Controller for Diffusion ModelsKuluhan Binici, Cihan Acar, Shivam Aggarwal, Siying Liu, Tulika Mitra. 355-360 [doi]
- Real-Time Semantic Video Communication with Temporally Consistent And Controllable Diffusion ModelsCem Eteke, Alexander Griessel, Wolfgang Kellerer, Eckehard Steinbach. 361-366 [doi]
- DIVA-VQA: Detecting Inter-Frame Variations in UGC Video QualityXinyi Wang 0011, Angeliki Katsenou, Dave Bull 0001. 367-372 [doi]
- Modality-Aware Diffusion Distillation Network for Sentiment Analysis in Missing ModalitiesZhiyu Liang, Yutian Li, Maolin Li, Lap-Kei Lee, Fu Lee Wang, Zhenguo Yang. 373-378 [doi]
- ARaBIQA: A Novel Blind Image Quality Assessment Model for Augmented RealityAymen Sekhri, Mohamed-Chaker Larabi, Seyed Ali Amirshahi. 379-384 [doi]
- Texturing Endoscopic 3D Stomach via Neural Radiance Field Under Uneven LightingZe-Yan Lu, Ren-Hau Shiue, Ming-Lun Han, Kuang-Chen Yen, Homer H. Chen. 385-390 [doi]
- Weighted Average Prediction for Region Adaptive Hierarchical Transform in Solid Geometry Point Cloud CompressionYingzhan Xu, Kai Zhang 0007, Li Zhang. 391-396 [doi]
- Vision Language Model Interpretability with Concept Guided DecodingPedro H. V. Valois, Dipesh Satav, Rodrigo A. P. de Campos, Gulpi Qorik Oktagalu Pratamasunu, Kazuhiro Fukui. 397-402 [doi]
- Rate-Distortion Optimized Chroma Quantization for Point Cloud CompressionBharath Vishwanath, Yingzhan Xu, Kai Zhang 0007, Li Zhang. 403-408 [doi]
- Compressing Multi-Scale Features with a Channel-Shrinked Single-Branch ArchitectureHanming Wang, Zijun Wu, Yunlong Li, Huifen Wang, Yuan Zhang. 409-414 [doi]
- Diversity-Driven Generative Dataset Distillation Based on Diffusion Model with Self-Adaptive MemoryMingzhuo Li, Guang Li 0008, Jiafeng Mao, Takahiro Ogawa 0001, Miki Haseyama. 415-420 [doi]
- Adversarial Image Purification by Explaining Adversarial DetectorsYi Ji, Tuo Ji, Hongliang Liu, Isao Echizen. 421-426 [doi]
- Curve: Clip-Utilized Reinforcement Learning for Visual Image Enhancement via Simple Image ProcessingYuka Ogino, Takahiro Toizumi, Atsushi Ito. 427-432 [doi]
- A Novel Downsampling Strategy Based on Information Complementarity for Medical Image SegmentationWenbo Yue, Chang Li 0001, Guoping Xu. 433-438 [doi]
- Teach Me Sign: Stepwise Prompting LLM for Sign Language ProductionZhaoyi An, Rei Kawakami. 439-444 [doi]
- Improved Cervical Cell Detection Model Based on Hybrid-Domain Feature Pyramid NetworkQian Huang 0008, Ziyang Yin, Yulin Chen, Xuejie Zhang, Hao Lu 0013, Zhaoyu Chen, Shaoling Qin. 445-450 [doi]
- Implicit Object Recognition via Reinforcement Learning in Out-Of-Domain ScenariosKenji Cari Koga, Rei Kawakami. 451-456 [doi]
- Semantic Context Re-Mining for Multimodal Guided Human-Object Interaction DetectionJihao Dong, Hua Yang. 457-462 [doi]
- Efficient Implicit Neural Representations for Videos with Feature ModulationHaeyoon Yang, Nam Ik Cho. 463-468 [doi]
- YOLO-VG: Enhancing Multi-Stage Feature Interaction for Visual GroundingYang Liu 0165, Le Jiang, Guoming Li, Xiaozhou Ye, Ye Ouyang. 469-473 [doi]
- Optimized Learned Image Compression for Facial Expression RecognitionXiumei Li, Marc Windsheimer, Misha Sadeghi, Björn M. Eskofier, André Kaup. 474-479 [doi]
- Joint Geometry-Attribute Point Cloud Compression with Spatial Context Mining and Dual-Class Attribute LossYangzhi Ma, Bojun Liu, Li Li 0040, Dong Liu 0002, Zhu Li 0001. 480-485 [doi]
- Enhancing Image Deraining Through VLM-Based Data Refinement and ClassificationShih-Jui Liang, Zihao Chen, Jun-Cheng Chen, Yan-Tsung Peng. 486-491 [doi]
- D2TR: Sea Clutter Suppression via Dynamic Dual-Tree Complex Wavelet Selection and Target-Guided RegularizationYuezheng Lv, Wenhui Li, Hongwei Dong, Meiqin Liu, Yifei Xu, Lingyu Si. 492-497 [doi]
- SFS-NeRF: Enhancing Geometry Consistency in Few-Shot Novel View Synthesis Through Surface-Aware Neural RenderingSeonji Park, Nam Ik Cho. 498-503 [doi]
- Sparse R-CNN OBB: Ship Target Detection in SAR Images Based on Oriented Sparse Learnable ProposalsKamirul Kamirul, Odysseas A. Pappas, Alin Achim. 504-509 [doi]
- BAIT: A New DNN Backdoor Attack Using Inpainted TriggersQuentin Le Roux, Yannick Teglia, Eric Bourbao, Philippe Loubet-Moundi, Teddy Furon. 510-515 [doi]
- GlioSurvNet: Multimodal Survival Prediction for Glioblastoma Using Deep Learning and Clinical Variables from Brain MRIGihyeon Kim, Fangxu Xing, Hyoun-Joong Kong, Emiliano Santarnecchi, Helen A. Shih, Thomas Bortfeld, Georges El Fakhri, Xiaofeng Liu 0001, Jang-Hwan Choi 0001, Jonghye Woo. 516-521 [doi]
- Dark Count Removal in Photon-Counting SPAD ArraysEdoardo Peretti, Aleksi Suonsivu, Lauri Salmela, Leevi Uosukainen, Radu Ciprian Bilcu, Giacomo Boracchi. 522-527 [doi]
- Cytofusion: A Latent Diffusion-Based Framework for Cytology ClassificationLinyi Qian, Qian Huang, Yulin Chen, Shaoling Qin. 528-533 [doi]
- Batch-Aware Active Learning for Object DetectionMykyta Kovalenko, Peter Eisert, Anna Hilsmann, Sebastian Bosse. 534-539 [doi]
- Test-Time Vocabulary Adaptation for Language-Driven Object DetectionMingxuan Liu, Tyler L. Hayes, Massimiliano Mancini, Elisa Ricci 0001, Riccardo Volpi, Gabriela Csurka. 540-545 [doi]
- A Generative Face Video Coding Framework with Disentangled and Consistent BackgroundShiv Gehlot, Guan-Ming Su, Peng Yin 0002, Sean McCarthy, Gary J. Sullivan. 546-551 [doi]
- CHTMAE: Cross-Modal Hierarchical Temporal-Spatial Masked Autoencoder Model for Micro-Expression RecognitionZhihua Xie, Haolin Chang, Guohua Miao, Zhaojin Lu. 552-557 [doi]
- TerraFly-Forensics: A Dataset for Forensic Detection of Generated Map Images with Quality Assessment of Generative ModelsArpan Mahara, Liangdong Deng, Naphtali David Rishe. 558-563 [doi]
- Weakly-Supervised Nuclei Segmentation Integrating Hybrid Decoder and Graph-Based Spatial ModelingQian Huang, Meng Geng, Yulin Chen, Xuejie Zhang, Shaoling Qin. 564-569 [doi]
- WaveE2VID: Frequency-Aware Event-Based Video ReconstructionRamna Maqsood, Paulo J. L. Nunes, Caroline Conti, Luís Ducla Soares. 570-575 [doi]
- Transductive One-Shot Learning Meet Subspace DecompositionKyle Stein, Andrew Arash Mahyari, Guillermo Francia, Eman El-Sheikh. 576-581 [doi]
- GMAR: Gradient-Driven Multi-Head Attention Rollout for Vision Transformer InterpretabilitySehyeong Jo, Gangjae Jang, Haesol Park. 582-587 [doi]
- Pose-Invariant Face Recognition via Feature-Space Pose FrontalizationNikolay Stanishev, Yuhang Lu, Touradj Ebrahimi. 588-593 [doi]
- Dynamic Mesh Coding With Temporally Consistent UV Atlas GenerationXudong Jin, Jianfeng Xu, Kei Kawamura. 594-599 [doi]
- Geometry Parametrization Stabilization For Dynamic Mesh CodingXudong Jin, Jianfeng Xu, Kei Kawamura. 600-604 [doi]
- Cross-Modality Abdominal Multi-Organ Segmentation via Source-Free Unsupervised Domain AdaptationAhmed El Sayed, Marwan Torki. 605-610 [doi]
- Common and Unique Representation Deep Embedded ClusteringDon Yates, Hakki Erhan Sevil, Arash Mahyari. 611-616 [doi]
- GIP: Gated Interaction Prompt for Parameter Efficient Vision-Language Fine-TuningXiang Lin, Weixin Li 0001, Shu Guo, Lihong Wang, Di Huang 0001. 617-622 [doi]
- Geometry Regularized Point Cloud AutoencoderRitwik Sadhu, Jiahao Pang, Dong Tian. 623-628 [doi]
- Enabling Controllable, Identity Preserving, Non-Rigid Edits in Human-Centric ImagesNikolai Warner, Jack Kolb, Meera Hahn, Jonathan Huang, Vighnesh Birodkar, Irfan Essa. 629-634 [doi]
- A Principled Diffusion Posterior Sampling for Inverse Problem with Mixed Poisson-Gaussian NoiseJi Li, Chao Wang. 635-640 [doi]
- CTU-Level Rate Control with λ Optimization Based on Visual Gaze Mechanism for 360-Degree Versatile Video CodingZeming Zhao, Meng Wang 0017, Xiangjie Sui, Xiaohai He, Shiqi Wang 0001. 641-646 [doi]
- Detection of Screen Usage During Eating Events Among Preschool-Aged ChildrenTonmoy Ghosh, Md Billlal Hossain, Steven Holiday, Matthew Cribbet, Susan W. White, Yu Gan 0003, Edward Sazonov. 647-652 [doi]
- DP-Net: A 3D Dilated Projection Framework For Precise Fetal Brain Tissue SegmentationJunpeng Tan, Mingjin Chen, Chunmei Qing, Xin Zhang 0013, Xiangmin Xu 0001. 653-658 [doi]
- NASSBLiF: No-Reference Light Field Image Quality Assessment Via Neighborhood Attention and Scale SwinMyllena Prado, Mylène C. Q. Farias. 659-664 [doi]
- Two-Stage Framework For Enhanced Hyperspectral Anomaly DetectionChi Zhang, Jungkwon Kim, Sangmin Kim, Jungi Lee 0001, Kwangsun Yoo, Seok-Joo Byun. 665-670 [doi]
- Robust Character Stroke Segmentation For Diverse Fonts Via Contour Matching and Chain PropagationHao Xia, Xueting Liu 0001, Chengze Li, Zhenkun Wen, Huisi Wu. 671-676 [doi]
- Enhancing Multiscale Feature Representation For Object-Level Recognition In Masked Image ModelingTsatsral Amarbayasgalan, Sungjun Wang, Mooseop Kim, Chi-Yoon Jeong. 677-682 [doi]
- Reward-Adaptation: A Novel Test-Time Adaptation Method With Reward ModelTongxi Song, Shuai Wang, Rui Li. 683-688 [doi]
- Multi-Res-3DGS: Multi-Resolution 3d Gaussian Splatting Bound with a Subdivided Mesh SequenceJianfeng Xu, Haruhisa Kato, Kei Kawamura. 689-694 [doi]
- BioVL-QR: Egocentric Biochemical Vision-And-Language Dataset Using Micro QR CodesTomohiro Nishimoto, Taichi Nishimura, Koki Yamamoto, Keisuke Shirai, Hirotaka Kameko, Yuto Haneji, Tomoya Yoshida, Keiya Kajimura, Taiyu Cui, Chihiro Nishiwaki, Eriko Daikoku, Natsuko Okuda, Fumihito Ono, Shinsuke Mori. 695-700 [doi]
- Task-Specific Spatiotemporal Context-Aware Decoupling for Occluded Video Object DetectionKaihong Li, Fei Chen, Xunxun Zeng, Wanling Liu, Huayi Chen. 701-706 [doi]
- Multi-Class Smoothed Hinge Loss Function in Pre-Training for Transfer LearningWonjik Kim, Masayuki Tanaka 0001, Masatoshi Okutomi, Hirokazu Nosato. 707-712 [doi]
- Visual Prompting Through Image MinesKalash Shah, J. Snehan, Gautam Bhutani, Kunal Singh, Shreyas Singh. 713-718 [doi]
- Stencil: Subject-Driven Generation with Context GuidanceGordon Chen, Ziqi Huang, Cheston Tan, Ziwei Liu 0002. 719-724 [doi]
- Multi-Teacher Knowledge Distillation for Efficient Object SegmentationSimon Zeng, Kurt Cutajar, Hanting Xie, Massimo Camplani, Richard Tomsett, Niall Twomey, Jas Kandola, Gavin K. C. Cheung. 725-730 [doi]
- Neighbor-Aware Feature-Driven Motion Compensation for Learned Video CompressionHao Lu, Qian Huang 0008, Ziyang Yin, Zaipeng Xie, Yiming Wang 0008. 731-736 [doi]
- Cmp: Composable Meta Prompt for Sam-Based Cross-Domain Few-Shot SegmentationShuai Chen, Fanman Meng, Chunjin Yang, Haoran Wei, Chenhao Wu, Qingbo Wu 0001, Hongliang Li 0001. 737-742 [doi]
- Extensions of Morphological Gradient for Hyperspectral ImagesLusine Davtyan, Sona Bezirganyan, Arpi Hunanyan, Yeva Gabrielyan, Aram Butavyan, Varduhi Yeghiazaryan. 743-748 [doi]
- EQUR: Equivariant Uncertainty Quantification and Refinement for Point Cloud RegistrationAdam Misik, Driton Salihu, Xiaoang Zhang, Heike Brock, Eckehard Steinbach. 749-754 [doi]
- HSBS: Comprehensive Boosting Of Facial Expression Recognition Via Hierarchical Semantic And Batch-Wise SimilarityZhiqing Wang, Jiabing Wang, Guihua Wen. 755-760 [doi]
- Watermarking Diffusion Models By Constructing Generative ClassifiersHaoyu Chen, Nan Zhong. 761-766 [doi]
- *Xiaoyu Ji 0004, Ali Shakouri, Fengqing Zhu 0001. 767-772 [doi]
- Guided Diffusion For Class-Conditioned Synthesis & Classification Of Microscopic Blood Cell ImagesKar-Ee Hoh, Junn Yong Loo, Yee Fan Tan, Raphaël C.-W. Phan, Chee-Ming Ting. 773-778 [doi]
- Unlocking A New Paradigm In Robustness For Multi-Step Facial Forgery DetectionShutiao Luo, Weinan Guan, Linna Zhou, Jing Dong 0003. 779-784 [doi]
- Exploring Effective Unfolding Covering Prompt Tuning for Vision MambaMingwang Wu, Yuetong Luo, Yankong Zhang, Bo Zhou, Shengeng Tang, Lechao Cheng. 785-790 [doi]
- Efficient Asymmetric Shared Low-Rank Adaptation Based on Selective Scanning Vision Mamba for Medical Imaging AnalysisZiqiu Dong, Yuetong Luo, Bo Zhou, Yankong Zhang, Shengeng Tang, Lechao Cheng. 791-796 [doi]
- Multimae Meets Earth Observation: Pre-Training Multi-Modal Multi-Task Masked Autoencoders for Earth Observation TasksJose Sosa, Danila Rukhovich, Anis Kacem 0001, Djamila Aouada. 797-802 [doi]
- Improving Yolov8 For Fast Few-Shot Object Detection By Dinov2 DistillationGuillaume Fourret, Marc Chaumont, Christophe Fiorio, Gérard Subsol. 803-808 [doi]
- F2T2-HIT: A U-Shaped FFT Transformer and Hierarchical Transformer for Reflection RemovalJie Cai 0001, Kangning Yang, Ling Ouyang, Lan Fu, Jiaming Ding, Huiming Sun, Chiu Man Ho, Zibo Meng. 809-814 [doi]
- Bayesian Surprise for Small and Sub-Pixel Moving Target DetectionLaurent Itti, Daben Liu, Corinne Teeter, Srideep Musuvathy. 815-820 [doi]
- Improving Novel View Synthesis of 360° Scenes in Extremely Sparse Views by Jointly Training Hemisphere Sampled Synthetic ImagesGuangan Chen, Anh Minh Truong, Hanhe Lin, Michiel Vlaminck, Wilfried Philips, Hiêp Quang Luong. 821-826 [doi]
- Towards Certified Object Detectors: Certified Runway Detection Using YoloAshutosh Kumar Nirala, Soumalya Sarkar. 827-832 [doi]
- J-CaPA : Joint Channel and Pyramid Attention Improves Medical Image SegmentationMarzia Binta Nizam, Marian Zlateva, James Davis 0001. 833-838 [doi]
- OpenRR-1k: A Scalable Dataset for Real-World Reflection RemovalKangning Yang, Ling Ouyang, Huiming Sun, Jie Cai 0001, Lan Fu, Jiaming Ding, Chiu Man Ho, Zibo Meng. 839-844 [doi]
- Eswindnet: Image Demoiréing Using Multiscale Swin Transformer LayersKarim Alaa, Marwan Torki. 845-850 [doi]
- Sparsity-Driven Parallel Imaging Consistency for Improved Self-Supervised MRI ReconstructionYasar Utku Alçalar, Mehmet Akçakaya. 851-856 [doi]
- Pose Estimation of Artwork Characters with Series and Parallel Dilated Convolution And Style Channel AttentionTomoya Matsukawa, Hideyuki Ogura, Shugo Yamashita, Kei Shibasaki, Masaaki Ikehara. 857-862 [doi]
- MFA-Net: Motion Field Adaptive Network for Skeleton-Based Action RecognitionQiang Geng, Qian Huang, Xing Li, Jiajie Lin, Yangyang Li, Xiang Zhang. 863-868 [doi]
- Fine-Grained Spatial-Temporal Perception for Gas Leak SegmentationXinlong Zhao, Shan Du. 869-874 [doi]
- Garment De-Warping for Virtual Try-on in the WildYu Gu, Jiexuan Zhang, Qian Wang, Jian Zhang. 875-880 [doi]
- Weakly Supervised Defect Localization with Residual FeaturesGaku Minamoto, Satoshi Ito, Osamu Yamaguchi, Takahiro Takimoto. 881-886 [doi]
- GRAFT-XPCI: Dataset of Synchrotron X-Ray Images for Detection of Acute Cellular Rejection after Heart TransplantationDonik Vrsnak, Nikola Skreb, Filip Loncaric, Ivo Planinc, Ivana Ilic, Bosko Skoric, Anne Bonnin, Hector Dejea, Davor Milicic, Maja Cikes, Sven Loncaric. 887-892 [doi]
- Deep Unsupervised Despeckling With Unbiased Risk EstimationAshutosh Gupta 0008, Chandra Sekhar Seelamantula, Thierry Blu, Nitant Dube, Shanmuganathan Raman. 893-898 [doi]
- Data-Driven Recursive Intra PredictionGayathri Venugopal, Jonathan Pfaff, Heiko Schwarz, Detlev Marpe, Thomas Wiegand 0001. 899-904 [doi]
- Improved UNet++ Based on Kolmogorov-Arnold ConvolutionsAhmed AL Qurri, Mohamed Almekkawy. 905-910 [doi]
- Radius-Aligned Training and Rotated IOU Metrics for Pedestrian Detection in Top-View Fisheye ImagesTsung-Tai Yang, Sheng-Ho Chiang, Tsaipei Wang. 911-916 [doi]
- Privacy-Preserving Face Recognition Scheme Based on Secure Data Storage and Secret SplittingXinrong Sun, Fanyu Kong 0002, Yunting Tao, Guoqiang Yang, Yuliang Shi. 917-922 [doi]
- Session Class Prototype Incremental Learning (SCPIL): Mitigating Catastrophic Forgetting with Distance-Based Prototype Learningseongsu Kim, Sangwoo Yun, Illhwan Kin, Dongheon Lee, Joonki Paik. 929-934 [doi]
- Enhancing Visual Question Answering Via Clustered In-Context Sequence ConfigurationZilong He, Yijun Pan, Hebei Li, Feipeng Ma, Yansong Peng, Siying Wu, Xiaoyan Sun 0001. 935-940 [doi]
- Continuous Action Unit Intensity Modeling for Micro-Expression RecognitionHanyu Jiang 0004, Jiayi Lyu, Xing Lan, Jian Xue 0002. 941-946 [doi]
- Toroidal Adaptive Intensity and Spectrum Updating Image Reconstruction for Fourier Ptychographic MicroscopyZewei Li, Wei Hu, Dajiang Lu, Cheng Liu, Yibin Tian. 947-952 [doi]
- Bits-to-Photon: End-to-End Learned Scalable Point Cloud Compression for Direct RenderingYueyu Hu, Ran Gong, Yao Wang 0001. 953-958 [doi]
- React: Reference-Based Anime Colorization TransformerLi-Ting Wang, Wen-Jiin Tsai. 959-964 [doi]
- Veta-Gs: View-Dependent Deformable 3d Gaussian Splatting for Thermal Infrared Novel-View SynthesisMyeongseok Nam, Wongi Park, Minsol Kim, Hyejin Hur, Soomok Lee. 965-970 [doi]
- Bicycledualnet: Bicyclegan-Powered Dual Encoder Network for Single Image 3D ReconstructionAditya Vallakatla, Ayan Chaudhury. 971-976 [doi]
- Harnessing the Power of LLMs for Image Aesthetics Assessment Through Semantic and Contextual understandingYoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi. 977-982 [doi]
- NAR-DIFF: A Noise-Adaptive Reflectance Diffusion Model for Low-Light Image EnhancementHaiyan Jin, Wenfan Yang, Haonan Su, Yuanlin Zhang, Bin Wang. 983-988 [doi]
- Multimodal Cell Context Instruction Tuning for Conditional DNA Regulatory Sequence Generation with Large Language ModelsJunhao Liu, Pengpeng Zhang, Siwei Xu, Shushrruth Sai Srinivasan, Yongxian Wu, Jing Zhang. 989-994 [doi]
- MPEG Edgebreaker: An Efficient Static and Dynamic Mesh Codec in MPEG V-DMCJiapan Zhao, Shizhuo Zhang, Wenjie Zou, FuZheng Yang 0001. 995-1000 [doi]
- Online Continual Learning of Diffusion Models: Multi-Mode Adaptive Generative DistillationRui Yang, Matthieu Grard, Emmanuel Dellandréa, Liming Chen 0002. 1001-1006 [doi]
- GeoScaler: Geometry and Rendering-Aware Downsampling of 3D Mesh TexturesSai Karthikey Pentapati, Anshul Rai, Arkady Ten, Chaitanya Atluru, Alan Bovik. 1007-1012 [doi]
- SCIGS: 3D Gaussians Splatting from A Snapshot Compressive ImageZixu Wang, Hao Yang, Yu Guo, Fei Wang. 1013-1018 [doi]
- ICP-3DGS: SFM-Free 3D Gaussian Splatting for Large-Scale Unbounded ScenesChenhao Zhang, Yezhi Shen, Fengqing Zhu 0001. 1019-1024 [doi]
- Saw-Monodetr: Shape-Aware Adaptive Weighted Transformer for Monocular 3d Object DetectionQuan Tran Dinh Dai, Thanh Huy Nguyen, Vinh Quang Dinh, Ren-Hung Hwang, Van Linh Nguyen. 1025-1030 [doi]
- Combination Test of NNVC Tools and NN-Inter In VVCQipu Qin, Cheolkon Jung. 1031-1036 [doi]
- GMD: A Multimodal Framework for AI-Generated Misinformation DetectionJunwen Duan, Wuyue Zhang, Zhende Liu. 1037-1042 [doi]
- Frequency Aware Learned Image Compression Using Swin Transformer and Discrete Wavelet TransformXu Liu, Cheolkon Jung. 1043-1048 [doi]
- Optimal Transport-Based Domain Alignment as a Preprocessing Step for Federated LearningLuiz Manella Pereira, M. Hadi Amini. 1049-1054 [doi]
- Perface: Metric Learning in Perceptual Facial Similarity for Enhanced Face AnonymizationHaruka Kumagai, Leslie Wöhler, Satoshi Ikehata, Kiyoharu Aizawa. 1055-1060 [doi]
- Non-Rigid Motion Correction for MRI Reconstruction via Coarse-to-Fine Diffusion ModelsFrederic Wang, Jonathan I. Tamir. 1061-1066 [doi]
- Siavatar: Animatable 3D Gaussian Avatar from a Single ImageZonghao Lin, Ruiyan Wang, Jun Ling, Li Song. 1067-1072 [doi]
- Consistent View Synthesis with Bidirectional Epipolar Attention and ReconstructionI-Chung Chiu, Jun-Cheng Chen, I-Hong Jhuo, Yen-Yu Lin. 1073-1078 [doi]
- RAVEN: Rethinking Adversarial Video Generation with Efficient Tri-Plane NetworksPartha Ghosh, Soubhik Sanyal, Cordelia Schmid, Bernhard Schölkopf. 1079-1084 [doi]
- Dynamic 3D Gaussian Reconstruction with Specular ReflectionMingyang Zhao 0001, Yuanzhi Xu, Yifan Zuo 0001, Xiaoshui Huang, Qiang Chen, Yuming Fang 0001. 1085-1090 [doi]
- METAREG: Robust Camera Parameter Estimation by Leveraging Noisy Camera ExtrinsicsChandrakanth Gudavalli, Tajuddin Manhar Mohammed, Ananth Vishnu Bhaskar, Elliot Staudt, Cheng Peng 0008, Abhay Yadav, Rama Chellappa, Shivkumar Chandrasekaran, B. S. Manjunath. 1091-1096 [doi]
- BSRPCA: A Simplified Blind Super-Resolved RPCA-Based Approach for Enhancing Blood Flow EstimationXuan Hieu Le, Jean-Pierre Remenieras, Denis Kouamé, Duong-Hung Pham. 1097-1102 [doi]
- Simple Zero-Shot Image DehazingJose Luis Lisani, J. Navarro, U. Untzilla. 1103-1108 [doi]
- ST-GRIT: Spatio-Temporal Graph Transformer For Internal Ice Layer Thickness PredictionZesheng Liu, Maryam Rahnemoonfar. 1109-1114 [doi]
- Blind Multi-Mode Ptychography using a Distributed Probe EstimateQiuchen Zhai, Gregery T. Buzzard, Kevin Mertes, Brendt Wohlberg, Charles A. Bouman. 1115-1120 [doi]
- Scribble-Guided Diffusion for Training-Free Text-to-Image GenerationSeonho Lee, Jiho Choi, Seohyun Lim, Jiwook Kim, Hyunjung Shim. 1121-1126 [doi]
- Deep Object Recognition-Based Analysis of Diverse Culinary LandscapesAibota Sanatbyek, Aknur Karabay, Huseyin Atakan Varol, Mei-Yen Chan. 1127-1132 [doi]
- EF2lane: Enhanced Feature Fusion 2D Lane Detection Network In 3d Point CloudYanrui Zhai, Zihui Jing, Xia Yuan. 1133-1138 [doi]
- Target Driven Adaptive Loss for Infrared Small Target DetectionYuho Shoji, Takahiro Toizumi, Atsushi Ito. 1139-1144 [doi]
- Power Cost Comparison of Neural-Network Compression Methods for Satellite ImageryNatàlia Blasco Andreo, Sebastià Mijares i Verdú, Marie Chabert, Thomas Oberlin, Joan Serra-Sagristà. 1145-1150 [doi]
- User-in-the-Loop View Sampling with Error Peaking VisualizationAyaka Yasunaga, Hideo Saito 0001, Shohei Mori. 1151-1156 [doi]
- Improving the Performance of Compressive Spectral Imaging with Bayer Color Filter ArrayZijun He, Ziyi Meng, Zhu Li, Xin Yuan. 1157-1162 [doi]
- Low-Rank Adaptation of Pre-Trained Vision Backbones for Energy-Efficient Image Coding For MachinesYichi Zhang, Zhihao Duan, Yuning Huang, Fengqing Zhu 0001. 1163-1168 [doi]
- Segment-Attention Augmented Dual-Contrastive Aggregation Learning for Unsupervised Visible-Infrared Person Re-IdentificationLiyun Liu, Luokun He, Wenjie Qian, Xiao Wang, Wei Wang. 1169-1174 [doi]
- Bidirectional Flow Fields for Sparse Input Novel View Synthesis of Dynamic ScenesKapil Choudhary, Nagabhushan Somraj, Rajiv Soundararajan. 1175-1180 [doi]
- Erp-Aware Text-To-360 Panorama Diffusion ModelJu-Hee Lee, Je-Won Kang. 1181-1186 [doi]
- A Retinex-Based Variational Model with A Nonlocal Gradient-Type Constraint for Low-Light Image EnhancementDaniel Torres, Catalina Sbert, Joan Duran. 1187-1192 [doi]
- Direction-Emphasizing Transformer for Road Extraction From Optical Remote Sensing ImageryPham-Khac Long, Nguyen-Hoang Duong, Dinh Hoan Trinh. 1193-1198 [doi]
- EventEgoHands: Event-Based Egocentric 3D Hand Mesh ReconstructionRyosei Hara, Wataru Ikeda, Masashi Hatano, Mariko Isogawa. 1199-1204 [doi]
- A dual branch graphic text detection network based on progressive Domain adaptationGang Zhou, Yuwei Feng, Tianci Zhang, Xinyi Chen, Li Zhang, Zhenhong Jia. 1205-1210 [doi]
- FPW: Frequency-Domain Pixel-by-Pixel Watermarking Against Unauthorized Images Used on Training Generative ModelJan Chi-Yuan, Hong-Han Shuai. 1211-1216 [doi]
- Dual Stream Networks for 3d Human Pose and Shape EstimationIoannis Pastaltzidis, Nikolaos Dimitriou, Stelios Krinidis, Dimitrios Tzovaras. 1217-1222 [doi]
- When 512×512 is Not Enough: Local Degradation-Aware Multi-Diffusion for Extreme Image Super-ResolutionBrian B. Moser, Stanislav Frolov, Tobias Christian Nauen, Federico Raue, Andreas Dengel 0001. 1223-1228 [doi]
- Frequency-Guided Contextual Image CaptioningAl Shahriar Rubel, Frank Y. Shih, Fadi P. Deek. 1229-1234 [doi]
- Rethinking Image Histogram Matching for Image ClassificationRikuto Otsuka, Yuho Shoji, Yuka Ogino, Takahiro Toizumi, Atsushi Ito. 1235-1240 [doi]
- Illumination Spectrum Estimation for Multispectral Images Using Illuminant PriorHyejin Oh, Je-Won Kang. 1241-1246 [doi]
- Grid-Logat: Grid Based Local And Global Area Transcription For Video Question AnsweringMd Intisar Chowdhury, Kittinun Aukkapinyo, Hiroshi Fujimura, Joo Ann Woo, Wasu Wasusatein, Fadoua Ghourabi. 1247-1252 [doi]
- GMOT-Mamba: Mamba-Based Model Prediction For Generic Multiple Object TrackingShashikant Verma, Nicu Sebe, Shanmuganathan Raman. 1253-1258 [doi]
- Darts: Deformable Animation Ready Templates for Clothing HumansShashikant Verma, Shanmuganathan Raman. 1259-1264 [doi]
- Handling Multiple Hypotheses In Coarse-To-Fine Dense Image MatchingMatthieu Vilain, Rémi Giraud, Yannick Berthoumieu, Guillaume Bourmaud. 1265-1270 [doi]
- PDD-AGENT: Multimodal Large Language Model-Driven AI Agent for Enhanced Plant Disease DiagnosisLufu Qin, Xingcai Wu, Xinyu Dong, Huan Wang, Tingwei Yang, Qi Wang. 1271-1276 [doi]
- Discrete Diffusion Propagated Transformer For Flexible Ureteroscopic Semantic SegmentationXiangtao Du, Mingxian Yang, Guangcheng Luo, Xiongbiao Luo. 1277-1282 [doi]
- Scalable Multi-View Clustering via Bipartite Graph Consensus FilteringHenghui Jiang, Yiqing Guo, Yan Chen 0036, Liang Du 0003. 1283-1288 [doi]
- Mosaic-SR: An Adaptive Multi-Step Super-Resolution Method For Low-Resolution 2d BarcodesEnrico Vezzali, Lorenzo Vorabbi, Costantino Grana, Federico Bolelli. 1289-1294 [doi]
- Diffusion Pretraining for Gait Recognition in the WildWei Ming Neo, Koichi Shinoda, Tat-Jen Cham. 1295-1300 [doi]
- Extension of Semi-Decoupled Partitioning in Inter FramesLiang Zhao, Madhu Peringassery Krishnan, Shan Liu 0001, Jayasingam Adhuran, Minhao Tang, Jianle Chen, Urvang Joshi, Mohammed Golam Sarwer, Debargha Mukerjee. 1301-1305 [doi]
- A Confidence-Based Sampling Strategy for Dense Temporal Token Learning in Thermal Infrared Object TrackingQuynh T. X. Hoang, Soan Thi Minh Duong, Ly Bui, Duy Q. Tran. 1306-1311 [doi]
- Adaptive Smoothing of Non-Rectangular Prediction Block Edges in the Wedge Mode of AVMPriyanka Das 0005, Tim Classen, Mathias Wien. 1312-1317 [doi]
- RN-Sam: Road Network-Aided Sam Optimization for Road Segmentation In Satellite ImageryRyosuke Kawamura, Pablo Guarda, Pradeep Narwade, Yash Patel, Koichiro Niinuma. 1318-1323 [doi]
- Semantics-Guided Generative Image CompressionCheng-Lin Wu, Hyomin Choi, Ivan V. Bajic. 1324-1329 [doi]
- Langvision-Lora-Nas: Neural Architecture Search for Variable Lora Rank In Vision Language ModelsKrishna Teja Chitty-Venkata, Murali Emani, Venkatram Vishwanath. 1330-1335 [doi]
- DiffDeMorph: Extending Reference-Free Demorphing to Unseen FacesNitish Shukla, Arun Ross. 1336-1341 [doi]
- Quantum-Enhanced Cancer Detection for Histopathologic ImagesNandika Goyal, Glen S. Uehara, Andreas Spanias. 1342-1347 [doi]
- SAM 2-Driven Self-Training for Mammogram Segmentation: Zero-Shot Mask Generation Via Pseudo-VideoMauricio Fernandez M, Yixiong Liang, Christopher A. Cochran. 1348-1353 [doi]
- Avoiding Bias While Pruning Neural Networks: The Case of Image ClassificationKursat Rasim Mestav, Iraj Saniee, Lisa Zhang 0001. 1354-1359 [doi]
- PixelShuffler: A Simple Image Translation through Pixel RearrangementOmar Zamzam. 1360-1365 [doi]
- GEE-UOD: An Underwater Object Detection Network Based on Global and Edge Information EnhancementWeirui Na, Yong Wang 0073, Chendong Xu, Zijun Huang, Qisong Wu. 1366-1371 [doi]
- Edge-Guided Monocular Absolute Depth Estimation with Diffusion-Based RefinementBashayer Abdallah, Shan-e-Ahmed Raza, Victor Sanchez. 1372-1377 [doi]
- Leveraging Complementary Attention Maps in Vision Transformers for OCT Image AnalysisHaz Sameen Shahgir, Tanjeem Azwad Zaman, Khondker Salman Sayeed, Md. Asif Haider, Sheikh Saifur Rahman Jony, M. Sohel Rahman. 1378-1383 [doi]
- MONSTR: Model-Oriented Neutron Strain Tomographic ReconstructionMohammad Samin Nur Chowdhury, Shimin Tang, Singanallur V. Venkatakrishnan, Hassina Z. Bilheux, Gregery T. Buzzard, Charles A. Bouman. 1384-1389 [doi]
- CMTM: Cross-Modal Token Modulation for Unsupervised Video Object SegmentationInseok Jeon, Suhwan Cho, Minhyeok Lee, Seunghoon Lee, Minseok Kang, Jungho Lee, Chaewon Park, Donghyeong Kim, Sangyoun Lee. 1390-1395 [doi]
- Visual Prompt Aided Single Shot Object Part SegmentationAnant Mohan, Yiyong Tan, Sarthak Harne, Viswanath Gopalakrishnan, Bhaskar Banerjee, Rishi Ranjan, Pradeep Rangdhol. 1396-1401 [doi]
- Fast Image Vector Quantization Using Sparse Oblique Regression TreesRasul Kairgeldin, Miguel Á. Carreira-Perpiñán. 1402-1407 [doi]
- Harnessing Feature Distribution Consistency for Federated Learning with Noisy LabelsYali Ma, Baoyao Yang, Yanchao Tang, Weide Zhan, Wenyin Yang. 1408-1413 [doi]
- Autoregression-Free Video Prediction Using Diffusion Model for Mitigating Error PropagationWoonho Ko, Jin Bok Park, Il Yong Chun. 1414-1419 [doi]
- Blind Denoising Using Dense in Dense Network with Attention ModuleJing-Ming Guo, Della Fitrayani Budiono, Yi-Chong Zeng, Zhen Yu Chen. 1420-1425 [doi]
- VIDA: Unsupervised Visible-to-Infrared Domain Adaptation for Object Detection Using Large Vision Language ModelChanyeong Park, Junbo Jang, Jiyoon Lee, Jaehong Yoon, Minju Baek, Joonki Paik. 1426-1431 [doi]
- Emomamba: Advancing Dynamic Facial Expression Recognition with Visual and Textual FusionLuong Phat Nguyen, Hazem Abdelkawy, Alice Othmani. 1432-1437 [doi]
- MCM: A Multi-Agent Collaborative Multimodal Framework For Traditional Chinese Medicine DiagnosisChendan Liang, Zeyu Ma 0003, Wanying Wang, Minjie Ding, Zhiyuan Cao, Mingang Chen. 1438-1443 [doi]
- Visual Encoders for Generalized Chromosome RecognitionRuijia Chang, Tao Zhou, Suncheng Xiang, Yujia Wang, Kui Su, Yin Zhou, Dahong Qian, Jun Wang 0072. 1444-1449 [doi]
- Remote Sensing Target Detector with Multi Scale Attention MechanismYan Li, Tao Gong, Qi Chu 0001, Bin Liu 0016, Nenghai Yu. 1450-1455 [doi]
- Diffuse and Refine Latent Prior with Transformers For Neural ISPZhipeng Mo, Wenbo Li, Sihao Ding 0004. 1456-1461 [doi]
- Knowledge Is What You Need For Active Object TrackingZiliang Guo, Ning Luo, Junhao Gu, Weiwu Yan, Xingqi Fang, Yu Qiao 0003. 1462-1467 [doi]
- Learned Video Compression with Spatial Correlation Priors and Hierarchical Temporal AttentionQian Huang 0008, Wenchao Shan, Qian Xu, Zaipeng Xie, Yiming Wang 0008. 1468-1473 [doi]
- F-LGAM: Enhancing Single Domain Generalized Object Detection Through Fourier-Based Local and Global Amplitude MixupChanyeong Park, Junbo Jang, Jaehong Yoon, Minju Baek, Joonki Paik. 1474-1479 [doi]
- Conditional Diffusion Transformer for Unified Distortion Correction and RectificationPooja Kumari 0001, Sukhendu Das. 1480-1485 [doi]
- FSAC-IA: A Hierarchical Constructed SAC-IA Algorithm for Point Cloud Alignment AccelerationZiyang Yu 0004, Qiong Chang, Jun Miyazaki. 1486-1491 [doi]
- RT-X Net: RGB-Thermal Cross Attention Network for Low-Light Image EnhancementRaman Jha, Adithya Lenka, Mani Ramanagopal, Aswin C. Sankaranarayanan, Kaushik Mitra. 1492-1497 [doi]
- IterDiff: Training-Free Iterative Face Editing Via Efficient Clip-Guided Memory BankChun-Yao Chiu, Feng-Kai Huang, Teng-Fang Hsiao, Hong-Han Shuai, Wen-Huang Cheng. 1498-1503 [doi]
- Daafnet: Domain Adaptive Augmented Feature Network for Biosignal based Emotion RecognitionSwathi Pratapa, Tushar Sandhan. 1504-1509 [doi]
- Policy Gradient-Based Optimal Subset Selection for Few-Shot Vision-Language LearningMuhammad Khizer Ali, Manoranjan Paul, Anwaar Ulhaq, Muhammad Haris Khan, Quazi Mamun. 1510-1515 [doi]
- Noisy Label Refinement with Semantically Reliable Synthetic ImagesYingxuan Li, Jiafeng Mao, Yusuke Matsui 0001. 1516-1521 [doi]
- In2Out: Fine-Tuning Video Inpainting Model for Video Outpainting Using Hierarchical DiscriminatorSangwoo Youn, Minji Lee, Tony Nokap Park, Yeonggyoo Jeon, Taeyoung Na. 1522-1527 [doi]
- ColorGPT: Automatic Colorization with Generative Prompts and TransformerJuntao Qiu, Yaping Zhao, Edmund Y. Lam. 1528-1533 [doi]
- Few-Shot Class-Incremental Learning for Efficient SAR Automatic Target RecognitionGeorge Karantaidis, Athanasios Pantsios, Ioannis Kompatsiaris, Symeon Papadopoulos. 1534-1539 [doi]
- Wavelet Packing for Self-Supervised Monocular Depth EstimationAyoub Rhim, Lei Qin, Rachid Benmokhtar, Xavier Perrotton. 1540-1545 [doi]
- Nonlinear Modifications of Transform Coefficients in VVC Intra CodingMichael Schäfer 0003, Florian Borzechowski, Heiko Schwarz, Jonathan Pfaff, Detlev Marpe, Thomas Wiegand 0001. 1546-1551 [doi]
- Moving Forward with BWC: The Faleb Dataset for Multimodal Image AnalysisSameer Hans, Jean-Luc Dugelay, Mohd Rizal Bin Mohd Isa, Mohammad Adib Khairuddin. 1552-1557 [doi]
- Multi-Scale Spatial-Frequency Features Representation and Learnable Cross Modal Feature Fusion in DeepFake DetectionYuzhi Lu, Wenyi Wang, Xiaowen Chen, Fengyu Wang, Shuai Wang, Jianwen Chen. 1558-1563 [doi]
- MGP-KAD: Multimodal Geometric Priors and Kolmogorov-Arnold Decoder for Single-View 3d Reconstruction in Complex ScenesLuoxi Zhang, Chun Xie, Itaru Kitahara. 1564-1569 [doi]
- MS-RAFT-3D: A Multi-Scale Architecture for Recurrent Image-Based Scene FlowJakob Schmid, Azin Jahedi, Noah Berenguel Senn, Andrés Bruhn. 1570-1575 [doi]
- Foundation Model-Based Deformable Registration of Multi-Modal Remote Sensing ImagesLinsi Wu, Kaichen Nie, Gang Shen, Xuefei Lv, Chenglong Wu, Yuru Pei. 1576-1581 [doi]
- A Novel Game Graphics Quality Evaluation Model Using Saliency and Resolution InformationBinlin Feng, Ying Chu, Li Zhou 0014, Hengyong Yu. 1582-1587 [doi]
- MM-IML: Multi-Modal Image Forgery Detection and LocalizationQing Huang, Xiangyu Yu, Zhipei Xu. 1588-1593 [doi]
- Enhanced Frame Context Initialization for Video Coding Beyond AV1Madhu Peringassery Krishnan, Liang Zhao, Zhipeng Dong, Tianqi Liu, Wei Kuang, Minhao Tang, Shan Liu 0001. 1594-1599 [doi]
- Diffusion-Based CT Image Segmentation for Intracerebral HemorrhageLili Wang, Pingping Cai, Zhuangzhuang Gu, Srihari Nelakuditi, Yan Tong. 1600-1605 [doi]
- ID-TTA: Classifier-Free Test Time Adaptation for Metric LearningSen Jia 0002, Amirhossein Hajavi, Homa Fashandi, Kevin Ferreira. 1606-1611 [doi]
- A Noise-to-Noise Training Approach for Robust Motion-Compensated Processing in Cardiac-Gated ImagesXirang Zhang, Yongyi Yang, Jovan G. Brankov, Michael A. King. 1612-1617 [doi]
- PSF-SRDN: Point Spread Function-Aware Speckle Reducing Diffusion NetworkSoumee Guha, Yi Huang, John A. Hossack, Scott T. Acton. 1618-1623 [doi]
- Learning from PU Data Using Disentangled RepresentationsOmar Zamzam, Haleh Akrami, Mahdi Soltanolkotabi, Richard M. Leahy. 1624-1629 [doi]
- Recovering and Classifying Upper Limb Impairment Trajectories After StrokeMartín Méndez-López, Alicia Fornés, Antonio Agudo. 1630-1635 [doi]
- ρ-NeRF: Leveraging Attenuation Priors in Neural Radiance Field for 3d Computed Tomography ReconstructionLi Zhou 0014, Changsheng Fang, Bahareh Morovati, Yongtong Liu, Shuo Han 0009, Yongshun Xu, Hengyong Yu. 1636-1641 [doi]
- A Novel Automated System for Pathological Lung Segmentation Using Modified Local Binary Patterns and Hierarchical TransformersAhmed Sharafeldeen, Fatma Taher, Mohammed Ghazal, Ashraf Khalil, Ali Mahmoud 0001, Sohail Contractor, Ayman El-Baz. 1642-1647 [doi]
- Diversifying Human Pose In Synthetic Data For Aerial-View Human DetectionYi-Ting Shen, Hyungtae Lee, Heesung Kwon, Shuvra S. Bhattacharyya. 1648-1653 [doi]
- ConvFuse: A Progressive Convformer Network for Context-Aware Multisensor Image FusionHafiz Tayyab Mustafa, Hamza Mustafa, Ik Hyun Lee, Zhonglong Zheng. 1654-1659 [doi]
- Long-Short Exposure Fusion With Event Data For Low-Light Video EnhancementDaizong Tian, Anustup Choudhury, Walt Husak. 1660-1665 [doi]
- Quanta-Slomo: Single Photon Camera Guided 100x Video Frame InterpolationWei Lin, Anustup Choudhury, Guan-Ming Su, Andreas Velten. 1666-1671 [doi]
- Hardware Friendly Multi-Hypothesis Cross Component PredictionTianqi Liu, Liang Zhao, Madhu Peringassery Krishnan, Shan Liu 0001, Jing Ye, Minhao Tang. 1672-1677 [doi]
- Re-Purposing Segment Anything For Skeleton Action LocalizationChristopher Bunn, Wanqing Li, Jack Yang. 1678-1683 [doi]
- A Debiasing Framework For Attribute Binding In Diffusion-Based Text-To-Image GenerationYueheng Luo, Tianwei Cao, Rui Wang, Ling Jin, Weidong Liu, Donghui Gao, Kongming Liang, Zhanyu Ma. 1684-1689 [doi]
- Viewpoint-Dependent 3D Visual Grounding for Mobile RobotsShogo Iwakata, Ryosuke Oshima, Hideki Tsunashima, Qi Feng, Hirokatsu Kataoka, Shigeo Morishima. 1690-1695 [doi]
- Parallel-Based Fast Coding Mode Decision for Intra Coding in VVC SCCDayong Wang, Kongqing Peng, Xin Lu 0001, Frédéric Dufaux, Shibin Zhang, Weian Li, Hongwei Guo 0001. 1696-1701 [doi]
- Shuffle PatchMix Augmentation with Confidence-Margin Weighted Pseudo-Labels for Enhanced Source-Free Domain AdaptationPrasanna Reddy Pulakurthi, Majid Rabbani, Jamison Heard, Sohail A. Dianat, Celso M. de Melo, Raghuveer Rao. 1702-1707 [doi]
- Oblique Decision Trees as an Image Model for Cubist Image RestylingEdric Chan, Magzhan Gabidolla, Miguel Á. Carreira-Perpiñán. 1708-1713 [doi]
- Extension of Sound Field Image Denoising to High-Frequency Sound Fields by Considering Wavenumber Spectral LossKazuma Kishida, Risako Tanigawa, Kenji Ishikawa, Yasuhiro Oikawa. 1714-1719 [doi]
- FaceLiVT: Face Recognition Using Linear Vision Transformer with Structural Reparameterization for Mobile DeviceNovendra Setyawan, Chi-Chia Sun, Mao-Hsiu Hsu, Wen-Kai Kuo, Jun-Wei Hsieh. 1720-1725 [doi]
- A Transparent and Lightweight Tumor-Aware MRI Super-Resolution Framework to Enhance Prostate Cancer DetectionVasileios Magoulianitis, Jiaxin Yang, Catherine A. Alexander, Masatomo Kaneko, Giovanni E. Cacciamani, Andre Abreu, C. C. Jay Kuo. 1726-1731 [doi]
- Unrolling Nonconvex Graph Total Variation for Image DenoisingSonglin Wei, Gene Cheung, Fei Chen, Ivan Selesnick. 1732-1737 [doi]
- Aggressive Rejection with Adaptive Gradient for Contaminated DataJungi Lee 0001, Jungkwon Kim, Chi Zhang, Sangmin Kim, Kwangsun Yoo, Seok-Joo Byun. 1738-1743 [doi]
- Triqa: Image Quality Assessment by Contrastive Pretraining on Ordered Distortion TripletsRajesh Sureddi, Saman Zadtootaghaj, Nabajeet Barman, Alan C. Bovik. 1744-1749 [doi]
- Training A Phase Detection Autofocus Model Using Hybrid LabelsChen-Han Lin, Homer H. Chen. 1750-1755 [doi]
- Enhancing Adversarial Robustness of Foundation Models Without Data CentralizationKoshiro Toishi, Keisuke Maeda, Ren Togo, Takahiro Ogawa 0001, Miki Haseyama. 1756-1761 [doi]
- A Green Learning Approach to LDCT Image RestorationWei Wang 0352, Yixing Wu, C. C. Jay Kuo. 1762-1767 [doi]
- Shape Reconstruction of Foreground and Background in Scenes with Translucent Objects Based on Coding CurvesWenbin Luo, Takafumi Iwaguchi, Ryusuke Sagawa, Hiroshi Kawasaki. 1768-1773 [doi]
- Time-Efficient Uncertainty Estimation Based on Target Networks in Deep Reinforcement LearningXionglue Li, Yongguang Wang, Lijuan Sun, Yongyong Chen. 1774-1779 [doi]
- Exploring The Potential of Vision-Language Models for Pure-Image and Text-Guided-Image Saliency PredictionYuxin Zhu, Huiyu Duan, Xiongkuo Min, Guangtao Zhai, Patrick Le Callet. 1780-1785 [doi]
- DPM-CLIP: Zero-Shot Multimodal Egocentric Activity Recognition based on Dual-Prediction MechanismYukun Chen, Liang Wan, Zihuan Qiu, Mingzhou He, Fanman Meng, Linfeng Xu 0001, Qingbo Wu 0001, Hongliang Li 0001. 1786-1791 [doi]
- Facial Identity Editing: Towards Effective De-IdentificationJinHyeong Park, Seangmin Lee, Muhammad Shaheryar, Soon Ki Jung. 1792-1797 [doi]
- DLP-YOLOv9: Model with Fewer Parameters and Higher Precision Based on Improved YOLOv9 in Drone-Captured-ScenariosJian Wang, Jia Su, Yongqing Sun. 1798-1803 [doi]
- Semantic Prototype-Guided Sampling for Long-Tailed Generalized Category DiscoveryNitu Pathak, Anwesha Banerjee, Soma Biswas. 1804-1809 [doi]
- A Multi-Layer End-to-End 360 Image CompressionDayong Wang, Yubiao Zhou, Yu Sun 0003, Frédéric Dufaux, Weian Li, Hui Guo, Ce Zhu. 1816-1821 [doi]
- Towards Image Copy Detection at E-Commerce ScaleVishnu Prabhakaran, Vishruit Kulshreshtha, Purav Aggarwal, Gokul Swamy 0002. 1822-1827 [doi]
- ACC: Alternating Complementary Colors for Display Energy ReductionKilian Ravon, Claire-Hélène Demarty, Laurent Blondé. 1828-1833 [doi]
- Diffusion Based Shape-Aware Learning with Multi-Scale Context for Segmentation of Tibiofemoral Knee Joint Tissues: an End-to-End ApproachAkshay Daydar, Alik Pramanick, Arijit Sur, Subramani Kanagaraj. 1834-1839 [doi]
- Improve Real-Time Flood Segmentation by Encoding and Distilling Foreground InformationPantelis Mentesidis, Vasileios Mygdalis, Ioannis Pitas. 1840-1845 [doi]
- Efficient Constraining of Transcoding in DNA-Based Image StorageSara Al Sayyed, Aline Roumy, Thomas Maugey. 1846-1851 [doi]
- Detection of Pavement Defects on Roads using a Multimodal YOLOv8 with Image and IMU DataArthur Polli, Ricardo Dutra da Silva, Rodrigo Minetto. 1852-1857 [doi]
- S3VD Self-Supervised Spatial Video Downsampling Loss: A Method for Training Video FPN Denoising NetworksHortensia Barral, Pablo Arias 0001, Axel Davy. 1858-1863 [doi]
- SLICE: Synthetic Caption-Trained Lightweight Image Captioner for Edge DevicesShayan Joya, Soroush Fatemifar, Ali Akbari 0003, Andrew Sheppard, Christopher Alder. 1864-1869 [doi]
- CorDis: A Novel Correlation-Based Disentanglement MeasureHazal Mogultay Ozcan, Sinan Kalkan, Fatos T. Yarman-Vural. 1870-1875 [doi]
- Event-Guided Motion Deblurring with Wavelet-Based Cross-Modal Feature FusionPei Shen, Cheolkon Jung. 1876-1881 [doi]
- Contextloss: Context Information for Topology-Preserving SegmentationBenedict Schacht, Imke Greving, Simone Frintrop, Berit Zeller-Plumhoff, Christian Wilms. 1882-1887 [doi]
- Mirror Feature-Aware Generative Adversarial Network for RGB-T Salient Object DetectionHaoyu Wang, Fangkai Zhao, Fangmei Chen, Fasheng Wang, Fuming Sun. 1888-1893 [doi]
- DGRGaze: A Difference-Guided Gaze Estimation Framework Based on 6D Rotation Matrix RepresentationXiaohao Wang, Sirui Zhao, Xinglong Mao, Yiming Zhang, Shifeng Liu, Tong Xu 0001, Enhong Chen. 1894-1899 [doi]
- Geometric Mean Improves Loss For Few-Shot LearningTong Wu, Takumi Kobayashi 0001. 1900-1905 [doi]
- A Multiscale Attention-Based Deep Learning Method for DCE-MRI Breast Tumor SegmentationPablo Giaccaglia, Isabella Poles, Valentina Lidoni, Veronica Rizzo, Michele Gentili, Federica Pediconi, Marco D. Santambrogio, Eleonora D'Arnese. 1906-1911 [doi]
- Energy Efficiency of Video Quality Assessment MetricsSteven Le Moan, Ha Thu Nguyen, Seyed Ali Amirshahi. 1912-1917 [doi]
- METAH2: A Snapshot Metasurface HDR Hyperspectral CameraYuxuan Liu, Qi Guo. 1918-1923 [doi]
- Error Correction for DNA-Based Image StorageDavi Lazzarotto, Michela Testolina, Touradj Ebrahimi. 1924-1929 [doi]
- Learning Geometry-Aware Representation for Gaze EstimationSiyuan Zhou, Qida Tan, Wenchao Du, Hu Chen 0002, Hongyu Yang 0002. 1930-1935 [doi]
- Divide-and-Summarize: Enhancing Deep Neural Video SummarizationEvangelos Charalampakis, Christos Papaioannidis, Ioannis Pitas. 1936-1941 [doi]
- Swinscale-LFVS: Parallel Feature Integration for Light Field View SynthesisMuhammad Zubair, Paulo J. L. Nunes, Caroline Conti, Luís Ducla Soares. 1942-1947 [doi]
- Constrained GAN-Generated X-Ray CT Data For Self-Supervised And Foundation-Model Segmentation Of Concrete MicrostructuresAmirkoushyar Ziabari, Anika Tabassum, Muralikrishnan Gopalakrishnan Meena, Amani Cheniour. 1948-1953 [doi]
- iHDR: Iterative HDR Imaging With Arbitrary Number Of ExposuresYu Yuan, Yiheng Chi, Xingguang Zhang, Stanley Chan. 1954-1959 [doi]
- Blaze: A Dataset For Wildfire And Burnt Area UAV Image Classification And SegmentationMichael Siavrakas, Christos Papaioannidis, Ioannis Pitas. 1960-1965 [doi]
- Sensor Distance Learning For Cross-Camera Color ConstancyRafique Ahmed, Damien Muselet, Philippe Colantoni, Alain Trémeau. 1966-1971 [doi]
- Unraveling Vanishing Point And Calibrating Tiny Objects For Semantic Scene CompletionSheng-Ping Yang, Yu-Wen Tseng, Yung-Chieh Yang, I-Bin Liao, Chi En Huang, Shen-Hsuan Liu, Yung-hui Li, Jhih-Ciang Wu, Hong-Han Shuai, Wen-Huang Cheng. 1972-1977 [doi]
- Domain Transfer Generative Model for New Face GenerationChun Chuen Hui, Wan-Chi Siu, H. Anthony Chan. 1978-1983 [doi]
- Lift-PCAC: Lifting Based Point Cloud Attribute CompressionRodrigo B. Pinheiro, Jean-Eudes Marvie, Giuseppe Valenzise, Frédéric Dufaux. 1984-1989 [doi]
- DTLS-Inpaint: Yet Another Efficient Image Inpainting with Domain TransferHon-Man Hammond Lee, Wan-Chi Siu. 1990-1995 [doi]
- Learned Hybrid Video Coding for Human Perception and Multiple Machine Vision TasksMartin Benjak, Saifullah Khan, Yi-Hsin Chen, Wen-Hsiao Peng, Jörn Ostermann. 1996-2001 [doi]
- Motion-Aware Reconstruction for Video Snapshot Compressive ImagingZhangyuan Li, Ping Wang, Haomiao Zhang, Zhu Li, Xin Yuan. 2002-2007 [doi]
- Tagsim: Topic-Informed Attention Guided Similarity Metric for Image Caption ComparisonVipul Chanchlani, Vishal Himmatsinghka, Ayush Himmatsinghka, Jivnesh Sandhan, Tushar Sandhan. 2008-2013 [doi]
- Clip-Ae: Clip-Assisted Cross-View Audio-Visual Enhancement for Unsupervised Temporal Action LocalizationRui Xia, Dan Jiang, Quan Zhang, Ke Zhang 0046, Chun Yuan 0003. 2014-2018 [doi]
- Single Snapshot Distillation for Phase Coded Mask Design in Phase RetrievalKaren Fonseca, León Suárez-Rodríguez, Andrés Jerez, Felipe Gutierrez-Barragan, Henry Arguello. 2019-2024 [doi]
- Probabilistic Sampling with Frobenius Norm for Action RecognitionAllassan Tchangmena A Nken, Susan McKeever, Peter Corcoran 0001, Ihsan Ullah 0002. 2025-2030 [doi]
- Multi-Level Statistical Model Guidance Improves Generalization for Biometric Synthetic Face DetectionJacob Piland, Christopher R. Sweet, Adam Czajka. 2031-2036 [doi]
- A Novel AI Framework for Breast Cancer Molecular Biomarker Response Score Detection on Cells Level Using Marker-Based Watershed Segmentation and Machine Learning ClassifiersAhmed Aboudessouki, Khadiga M. Ali, Ahmed Alksas, Mohamed Elsharkawy 0002, Mohamed T. Azam, Hossam Magdy Balaha, M. Aborahma, Ali Mahmoud 0001, Mohammed Ghazal, Fatma Taher, Nagham E. Mekky, Fathi E. Abd El-Samie, Dibson D. Gondim, Ayman El-Baz. 2037-2042 [doi]
- Depth-Aware Scoring and Hierarchical Alignment for Multiple Object TrackingMilad Khanchi, Maria Amer, Charalambos Poullis. 2043-2048 [doi]
- SCL-GAN: Spatially-Correlative Lightweight GAN for Efficient and High-Fidelity Thermal-Visible Face SynthesisNand Kumar Yadav, Rayeesa Mehmood, Rodrigue Rizk, Kc Santosh. 2049-2054 [doi]
- Stable-Invertible Graph Convolutional Networks for Label-Efficient Skeleton-Based RecognitionHichem Sahbi. 2055-2060 [doi]
- Towards All-Time, All-Weather Fod Detection Through Generative AIXi Qin, Sirui Song, Jackson Brengman, Chris Bartone, Jundong Liu. 2061-2066 [doi]
- DSFace : Conditional Diffusion Inpainting for Sketch-to-Face SynthesisSanhita Pathak, Vinay Kaushik, Brejesh Lall. 2067-2072 [doi]
- Is Perturbation-Based Image Protection Disruptive to Image Editing?Qiuyu Tang, Bonor Ayambem, Mooi Choo Chuah, Aparna Bharati. 2073-2078 [doi]
- Enhancing Medical Vision-Language Models with Rich Textual Descriptions and Multiple Alignments for Chest X-Ray DiagnosisYoussef Ibrahim, Anabia Sohail, Sajid Javed, Hasan Almarzouqi, Mohamed Deriche 0001, Naoufel Werghi. 2079-2084 [doi]
- PIT-QMM: A Large Multimodal Model for No-Reference Point Cloud Quality AssessmentShashank Gupta, Gregoire Phillips, Alan C. Bovik. 2085-2090 [doi]
- Efficient Leaf Disease Classification and Segmentation Using Midpoint Normalization Technique and Attention MechanismEnam Ahmed Taufik, Antara Firoz Parsa, Seraj Al Mahmud Mostafa. 2091-2096 [doi]
- Towards Test Time Adaptation in Low Dose Computed Tomography Denoising Via Bias ModulationSutanu Bera, Krishnendu Ghosh, Prabir Kumar Biswas. 2097-2102 [doi]
- FGA-NN: Film Grain Analysis Neural NetworkZoubida Ameur, Frédéric Lefèbvre, Philippe Delagrange, Milos Radosavljevic. 2103-2108 [doi]
- Investigating Robustness of Unsupervised Stylegan Image RestorationAkbar Ali, Indra Deep Mastan, Shanmuganathan Raman. 2109-2114 [doi]
- Linea: Fast and Accurate Line Detection using Scalable TransformersSebastian Janampa, Marios Pattichis. 2115-2120 [doi]
- Adaptive Hierarchical Feature Difference Auto-Encoder for Robust RGB-T Object TrackingMohamed Awad, Ahmed S. Elliethy, M. Omair Ahmad, M. N. S. Swamy 0001. 2121-2126 [doi]
- Investigating Data Replication in Medical Synthetic Image Generation with Diffusion ModelsAimon Rahman, Jeya Maria Jose Valanarasu, Vishal M. Patel. 2127-2132 [doi]
- Texture- and Shape-Based Adversarial Attacks for Overhead Image Vehicle DetectionMikael Yeghiazaryan, Sai Abhishek Si Namburu, Emily Kim, Stanislav Panev, Celso Miguel de Melo, Fernando De la Torre, Jessica K. Hodgins. 2133-2138 [doi]
- Cross-Modal Attention with Adaptive and Hierarchical Fusion for Robust RGB-T Image Segmentation for Safe DrivingSaheli Hazra, Ujjwal Bhattacharya. 2139-2144 [doi]
- COT-AD: Cotton Analysis DatasetAkbar Ali, Mahek Vyas, Soumyaratna Debnath, Chanda Grover Kamra, Jaidev Sanjay Khalane, Reuben Shibu Devanesan, Indra Deep Mastan, Subramanian Sankaranarayanan, Pankaj Khanna, Shanmuganathan Raman. 2145-2150 [doi]
- Towards Dark-Field X-ray Microscopy Through Coherent EncodingDoga Gürsoy, Stephan Hruszkewycz. 2151-2156 [doi]
- Measuring Distortion Strength with Dewarping Diffusion Models in Anomaly DetectionAkira Uchida, Satoshi Ikehata, Yuichi Yoshida, Ikuro Sato. 2157-2162 [doi]
- LeMoRe: Learn More Details for Lightweight Semantic SegmentationMian Muhammad Naeem Abid, Nancy Mehta, Zongwei Wu, Radu Timofte. 2163-2168 [doi]
- A Tree of Shapes Computation Algorithm for Massively Parallel ArchitecturesEdwin Carlinet, Baptiste Esteban. 2169-2174 [doi]
- Non-Local N2V: Improving N2V Networks for Spatially Correlated NoiseDiego Martin, Edoardo Peretti, Giacomo Boracchi. 2175-2180 [doi]
- Bridging Domain Shifts Through Self-Contrastive Learning And Distribution AlignmentVinicius O. Avena, Rodrigo S. Couto 0001, Luís Henrique M. K. Costa, Eduardo A. B. da Silva. 2181-2186 [doi]
- Anchor-Based Gravity Alignment for PanoramasMatheus A. Bergmann, Rômulo Marconato Stringhini, Thiago L. T. da Silveira, Cláudio R. Jung. 2187-2192 [doi]
- A Generative Diffusion Model to Solve Inverse Problems for Robust in-NICU Neonatal MRIYamin Ishraq Arefeen, Brett Levac, Jonathan I. Tamir. 2193-2198 [doi]
- A 3D Mesh Convolution-Based Autoencoder for Geometry CompressionGermain Bregeon, Marius Preda, Radu Ispas, Titus Zaharia. 2199-2204 [doi]
- One-stage Framework for Thyroid Nodule Detection with Mixup and Negative Sample UtilizationYuxuan He, Qilei Chen, Zinan Xiong, Xiaolong Liang, Yu Cao 0002, Benyuan Liu. 2205-2210 [doi]
- Advancing Limited-Angle CT Reconstruction through Diffusion-Based Sinogram CompletionJiaqi Guo, Santiago López-Tapia, Aggelos K. Katsaggelos. 2211-2216 [doi]
- Dynamic Mesh Coding Using Edge Length-Based Adaptive SubdivisionTomoya Naganuma, Danillo Bracco Graziosi, Ali J. Tabatabai, Kao Hayashi, Satoru Kuma, Ohji Nakagami. 2217-2222 [doi]
- Facilitate and Scale Up the Creation of 3D Meshes, 6D Category-Based Datasets and Grasping with Generative Models: GenVegeFruits3DGuillaume Duret, Younes Bourennane, Danylo Mazurak, Anna Samsonenko, Florence Zara, Jan Peters 0001, Liming Chen 0002. 2223-2228 [doi]
- Splitter: Faster Inference through Channel Partitioning and Feature FusionOnur Can Koyun, Kemal Ilgar Eroglu, Behçet Ugur Töreyin. 2229-2234 [doi]
- DIFFUSE2ADAPT: Controlled Diffusion for Synthetic-to-Real Domain AdaptationKetul Shah, Arushi Sinha, Arun V. Reddy, Aniket Roy, Rama Chellappa. 2235-2240 [doi]
- Category-Dependent Learned Image Compression for Smartphone Photography with Standard-Compliant DecodersAbdellah El Mennaoui, Ghalia Hemrit, Jean-Luc Dugelay. 2241-2246 [doi]
- A Warmer Start to Active Learning with Adaptive Gaussian Mixture Models for Skin Lesion SegmentationLakmali Nadeesha Kumari, Chanaka Thushitha Bandara, Chen-Nee Chuah, Sen-ching Samson Cheung. 2247-2252 [doi]
- Segmentation for Early Tumor Detection in Mammograms Via Temporal Discrepancy Analysis and Dynamic Loss WeightingAfsana Ahsan Jeny, Sahand Hamzehei, Mostafa Karami, Stephen Andrew Baker, Tucker Van Rathe, Clifford Yang, Sheida Nabavi. 2253-2258 [doi]
- Advancements in Medical Image Classification Through Fine-Tuning Natural Domain Foundation ModelsMobina Mansoori, Sajjad Shahabodini, Farnoush Bayatmakou, Jamshid Abouei, Konstantinos N. Plataniotis, Arash Mohammadi 0001. 2259-2264 [doi]
- PetsRS - a Dataset and Benchmark for Pet Recognition on a Climate Disaster ScenarioPaulo G. L. Pinto, Thiago L. T. da Silveira, Cláudio R. Jung. 2265-2270 [doi]
- RAW: Region Attention-Weighted Guided Network with Inter-Region Exchange for AMD GradingIbrahim Abdelhalim, Mohamed El-Sharkawy 0002, Fatma Taher, Wei Wang, Mohammed Ghazal, Ali Mahmoud 0001, Ayman El-Baz. 2271-2276 [doi]
- Group Joint Independent Component Analysis (Group jICA): a Novel Method to Jointly Decompose and Link Simultaneous EEG and fMRISouvik Phadikar, Oktay Agcaoglu, Vince D. Calhoun. 2277-2281 [doi]
- Energy-Based Generative Models with Morphological Attention Networks for Hyperspectral Image Classification: a Unified FrameworkMohammad Arif Hossain, Yeahia Sarker, Weiqi Liu, Nirwan Ansari. 2282-2287 [doi]
- Graph Convolutional Network Aggregation For Broad-Spectral Object DetectionJunting Deng, Ethan Chen, Vanessa Chen. 2288-2293 [doi]
- Afmunet: Adaptive Filter-Based Frequency Modulation UNET For OCTA SegmentationIbrahim Abdelhalim, Mohamed El-Sharkawy 0002, Fatma Taher, Ashraf Khalil, Mohammed Ghazal, Ali Mahmoud 0001, Ayman El-Baz. 2294-2299 [doi]
- Crossdr: Bridging 2D And 3D Features For Diabetic Retinopathy Classification Using Context-Aware Cross-AttentionMohamed El-Sharkawy 0002, Ibrahim Abdelhalim, Fatma Taher, Asem M. Ali, Mohammed Ghazal, Ali Mahmoud 0001, Guruprasad Giridharan, Wei Wang, Ayman El-Baz. 2300-2305 [doi]
- Generative Face Video Compression Using Depth Estimation and Compressed SensingChang Hao, Cheolkon Jung. 2306-2311 [doi]
- Real-Time Traffic Accident Anticipation with Feature ReuseInpyo Song, Jangwon Lee. 2312-2317 [doi]
- Fast and Accurate Outlier-Aware Lidar Super-Resolution for Slam ApplicationsChristos Anagnostopoulos, Alexandros Gkillas, Nikos Piperigkos, Aris S. Lalos. 2318-2323 [doi]
- Reading Between the Lines: How Eye-Tracking Data can Inform Reading Strategies for Large Language ModelsHao Wang, Qingxuan Wang, Huiran Zhang, Pinpin Zhu. 2324-2329 [doi]
- X265-PVMAF: A Real-Time Perceptual Video Quality Metric for HEVC Video EncodingAxel De Decker, Sangar Sivashanmugam, Jan De Cock, Hannes Mareen, Peter Lambert, Glenn Van Wallendael. 2330-2335 [doi]
- Event-Based Egocentric Human Pose Estimation in Dynamic EnvironmentWataru Ikeda, Masashi Hatano, Ryosei Hara, Mariko Isogawa. 2336-2341 [doi]
- Certainty and Uncertainty Guided Active Domain AdaptationBardia Safaei 0002, Vibashan VS, Vishal M. Patel. 2342-2347 [doi]
- Pose-Free 3D Gaussian Splatting via Shape-Ray EstimationYoungju Na, Taeyeon Kim, Jumin Lee, Kyu Beom Han, Woo-Jae Kim, Sung-Eui Yoon. 2348-2353 [doi]
- VisionScores - A System-Segmented Image Score Dataset for Deep Learning TasksAlejandro Romero Amezcua, Mariano José Juan Rivera Meraz. 2354-2359 [doi]
- A Benchmark Dataset for Automated Diagnosis and Treatment Planning of Class III Malocclusion Using X-Rays and Profile PhotosOmid Halimi Milani, Emadeldeen Hamdan, Marouane Tliba, Samim Taraji, Veerasathpurush Allareddy, Aladine Chetouani, Rachid Jennane, Ahmet Enis Çetin, Mohammed H. Elnagar. 2360-2365 [doi]
- Similarity Normalization and Strong Geometric Augmentation for Local Feature Matching Under Large Scale and Rotation ChangesYuya Matsumoto, Kazumine Ogura, Gaku Nakano. 2366-2371 [doi]
- Rate-Distortion Optimization with Non-Reference Metrics for UGC CompressionSamuel Fernández-Menduiña, Xin Xiong, Eduardo Pavez, Antonio Ortega, Neil Birkbeck, Balu Adsumilli. 2372-2377 [doi]
- Diffusion to Confusion: Naturalistic Adversarial Patch Generation Based on Diffusion Model for Object DetectorShuo-Yen Lin, Ernie Chu, Po-Hung Yeh, Jun-Cheng Chen, Jia-Ching Wang. 2378-2383 [doi]
- EXDF: Explainable Deepfake Detection with Vision-Language ModelShu-Tzu Lo, Tai-Ming Huang, Yue-Hua Han, Kai-Lung Hua, Jun-Cheng Chen. 2384-2389 [doi]
- Overlooked Factors in Continual Zero-Shot Learning: Inflexible Semantic Prototypes, Simplistic Loss Functions, and SGD NoiseQingyang Hao, Lei Li 0051, Chun Yuan 0003. 2390-2395 [doi]
- Event Denoising Based on Iterative Tree-Structured Information AggregationYueyang Xu, Chengjie Ge, Xueyang Fu, Zheng-Jun Zha. 2396-2401 [doi]
- Rapid Object Modeling Initialization for Vector Quantized-Variational AutoEncoderMichael Karnes, Alper Yilmaz 0001. 2402-2407 [doi]
- 3D Magnetic Inverse Routine for Single-Segment Magnetic Field ImagesJ. Senthilnath 0001, Chen Hao, F. C. Wellstood. 2408-2413 [doi]
- Adaptive Voxelization for Transform Coding of 3D Gaussian Splatting DataChenjunjie Wang, Shashank N. Sridhara, Eduardo Pavez, Antonio Ortega, Cheng Chang. 2414-2419 [doi]
- Transform Set Merging for Neural Network-Based Intra Prediction in beyond VVCMuho Cheon, Hongkwon Pai, Byeungwoo Jeon. 2420-2425 [doi]
- Non-Uniform Illumination Image Restoration for Deep-Sea Exploration with A New Scattering ModelXiaoran Jiang, Yihui Fan, Xin Jin. 2426-2431 [doi]
- Holistic Coreset Selection for Data Efficient Image Quality AssessmentArpita Nema, Hanwei Zhu, Weisi Lin. 2432-2437 [doi]
- Lightweight Image Super-Resolution Preprocessor for Jpeg CompressionMeishi Jiang, Nianxiang Fu, Zhenzhong Chen. 2438-2443 [doi]
- SPC TO 3d: Novel View Synthesis from Binary SPC VIA I2I TranslationSumit Sharma 0014, Gopi Raju Matta, Kaushik Mitra. 2444-2449 [doi]
- DFT Gaze: Distilled and Fine-Tuned Gaze Estimation for Personalization on Tiny DevicesHe-Yen Hsieh, Ziyun Li, Sai Qian Zhang, Wei-Te Mark Ting, Kao-Den Chang, Barbara De Salvo, Chiao Liu, H. T. Kung 0001. 2450-2455 [doi]
- Realistic Skin Trouble Simulation Via Image Generation ModelsJinhee Lee, Chanhyuk Lee, HuiSu Yoon, Semin Kim, Jongha Lee. 2456-2461 [doi]
- Skin Cancer Classification Using Extended 5 Channel (I-RGB-U) Images Generated From RGB ImagesRyota Fuse, Koki Shimizu, Terumasa Aoki. 2462-2467 [doi]
- Enhanced Multi-Scale Network for Single Image Super-ResolutionNashra Babar, M. Omair Ahmad. 2468-2473 [doi]
- High-Frequency Semantic Enhancement in Compressed Scenarios for Robust Visual and Machine Vision ApplicationsKeren He, Chen Fu, Guangwei Gao, Jinjia Zhou. 2474-2479 [doi]
- Ridgeformer: Mutli-Stage Contrastive Training for Fine-Grained Cross-Domain Fingerprint RecognitionShubham Pandey, Bhavin Jawade, Srirangaraj Setlur. 2480-2485 [doi]
- Towards Robust Text-Guided Image Compression Under Modality MissingGenhong Wang, Wen Tan 0001, Fanyang Meng, Yongsheng Liang 0001. 2486-2491 [doi]
- Efficient Random Access Method Using Seed and Inter-Key Frames for Next Generation Video CodecByeongdoo Choi, Andrew Segall, Kiran M. Misra. 2492-2497 [doi]
- Multi-Class Part Parsing Based on Multi-Class BoundariesNjuod Alsudays, Jing Wu 0004, Yu-Kun Lai, Ze Ji. 2498-2503 [doi]
- CHUG: Crowdsourced User-Generated HDR Video Quality DatasetShreshth Saini, Alan C. Bovik, Neil Birkbeck, Yilin Wang 0001, Balu Adsumilli. 2504-2509 [doi]
- Audio Visual Segmentation through Text EmbeddingsKyungbok Lee, You Zhang 0001, Zhiyao Duan. 2510-2515 [doi]
- Robust Estimation of Bump Height for Wafer-Level Packaging Using Optical TriangulationSeungmi Oh, Yujin Jang, Jeongtae Kim. 2516-2521 [doi]
- Robust Multi-Label Learning with Human-Guided and Foundation Model-Aided Crowd FrameworkFaizul Rakib Sayem, Shahana Ibrahim. 2522-2527 [doi]
- Spectral Mixing Augmentation for Preventing False Positives from Hyperspectral Anomaly DetectionSangmin Kim, Jungkwon Kim, Chi Zhang, Jungi Lee, Kwangsun Yoo, Seok-Joo Byun. 2528-2533 [doi]
- Efficient Atlas Generation for Medical Imaging Via Groupwise Latent Diffusion ModelsZiyi He, Albert C. S. Chung. 2534-2539 [doi]
- Cloud Optical Thickness Retrievals Using Angle Invariant Attention Based Deep Learning ModelsZahid Hassan Tushar, Adeleke Ademakinwa, Jianwu Wang 0001, Zhibo Zhang, Sanjay Purushotham. 2540-2545 [doi]
- A Scalable Image Compression Using Conditional Diffusion Model in Human-Machine Hybrid VisionJinhao Kuang, Yue Luo, Yi Peng, Jiabao Zhu, Li Yu 0003. 2546-2551 [doi]
- Boosted Affine Motion Compensation For Geometric Partitioning ModeYang Wang, Kai Zhang 0007, Li Zhang. 2552-2557 [doi]
- Lorentz Transformation Neural NetworkWenyuan Li 0007, Jingchao Wang 0002, Guoheng Huang, Tongxu Lin, Guo-Zhong, Xiaochen Yuan, Chi-Man Pun, Zhibo Wang, An Zeng. 2558-2563 [doi]
- Object Detection and Fruit Tree Growth Stage Identification Via YOLO with Inverted and Swin Transformer BlocksKuan-Hsien Liu, Mingru Wang, Tsung-Jung Liu. 2564-2569 [doi]
- Large Vision-Language Models are Generalist Solvers For Pathology TasksShengxuming Zhang, Hengrui Lou, Jing Zhang 0120, Xiuming Zhang, Mingli Song, Zunlei Feng. 2570-2575 [doi]
- A Novel Explainable AI-Based System For Improved Prediction of Breast Cancer Response to Neoadjuvant ChemotherapyFatma M. Talaat, Hanaa ZainEldin, Mohamed Shehata 0002, Eman Alnaghy, Reham Alghandour, Khadiga M. Ali, Sohail Contractor, Ayman El-Baz. 2576-2581 [doi]
- Multi-View Amodal Instance Segmentation Based on 3d RepresentationChang Liu, Ya-Li Hou, Bingchuan Chen. 2582-2587 [doi]
- Knowledge Refinement For Unsupervised Lifelong Person Re-IdentificationSeungbin Hong, Jae-Young Sim. 2588-2593 [doi]
- Joint Optimization of Primary and Secondary Transforms Using Rate-Distortion Optimized Transform DesignDarukeesan Pakiyarajah, Eduardo Pavez, Antonio Ortega, Debargha Mukherjee, Onur G. Guleryuz, Keng-Shih Lu, Kruthika Koratti Sivakumar. 2594-2599 [doi]
- Structured Instruction Parsing and Scene Alignment For UAV Vision-Language NavigationLiangyu Zhou, Rui Xue, Xiaoyan Luo. 2600-2605 [doi]
- Anti-FT: Towards Practical Deep Leakage From GradientsLinghui Zhu, Yiming Li 0004, Haiqin Weng, Yan Liu, Shu-Tao Xia, Zhi Wang 0001. 2606-2611 [doi]
- BreathAI: Transfer Learning-Based Thermal Imaging for Automated Breathing Pattern RecognitionHamza Kheddar, Yassine Himeur, Abbes Amira. 2612-2617 [doi]
- Attribute-Specified Generation And Style-Transfer Diffusion For Face Recognition EnhancementChing-Hsun Chang, Ming-Hao Lee, Yu-Hsuan Chiu 0001, Gee-Sern Jison Hsu, Sheng-Luen Chung. 2618-2623 [doi]
- Multimodal-LLM Agent For Text-Driven Multi-Attribute Face EditingLang Yue, Yiling Wu, Libo Zhang. 2624-2629 [doi]
- Dual-Stream Spatio-Temporal Accident Anticipation and DetectionZongyao Li, Satoshi Yamazaki, Jianquan Liu. 2630-2635 [doi]
- CADOT: Cityscape Aerial Image Dataset For Object DetectionMinh Duc Vu, Anissa Mokraoui, Fangchen Feng, Bouzid Arezki, Borel Sonna, Bissmella Bahaduri, Hicham Talaoubrid. 2636-2641 [doi]
- Holism To Atomism: Enhancing The Vision-Language Alignment For Cross-Modal Few-Shot LearningBoyu Yang, Mingjie Li, Xi Chen, Liang Li, Chao Deng, Junlan Feng. 2642-2647 [doi]
- Deep Unfolding-Based Image Reconstruction For Quanta Image SensorsWataru Otobe, Kosuke Kurihara, Yoshihiro Maeda, Takayuki Hamamoto. 2648-2653 [doi]
- A Physics-Guided Smoothing Method For Material Modeling With Digital Image Correlation (DIC) MeasurementsJihong Wang, Chung-Hao Lee, William Richardson, Yue Yu. 2654-2659 [doi]
- Sinogram Inpainting with Physics-Guided Latent Diffusion Model for Synchrotron Light SourcesSrutarshi Banerjee, Jiaze E, Bin Ren 0002, Tekin Bicer. 2660-2665 [doi]
- Enhancing 3D Scene Representation with Structural Dissimilarity-Aware LearningSeungjae Lee, Ho-Jun Kim, Hak Gu Kim. 2666-2670 [doi]
- Machine Learning-Based Decoding Energy Modeling for VVC StreamingReza Farahani, Vignesh V. Menon, Christian Timmerer. 2671-2676 [doi]
- Deformable Shape Registration from Inexact CorrespondencesRahul Barman, Ayan Chaudhury. 2677-2682 [doi]
- Fast Iterative Enhancement for Image Signal ProcessingMarcos V. Conde, Radu Timofte. 2683-2688 [doi]
- Mamba-Based Global Correlation Learning for Light Field Spatial Super-ResolutionBo Peng, Ruoxi Li, Jianjun Lei, Zhe Zhang. 2689-2693 [doi]
- Sketch to Stylized-Image: A Two-Stage Approach for Artistic Image GenerationJiyoon Kim, Junha Park, Jong-Seok Lee. 2694-2699 [doi]
- Anchor-ViT: Spatially-Focused Vision Transformer for Distracted Driving DetectionVivan Doshi. 2700-2705 [doi]
- Reverse Distillation Based Detection of Anomalies on a Newly Developed Fabric DatasetChristian Jaspert, Radu Timofte. 2706-2711 [doi]
- FC-Render: Adaptive Font- and Color-Aware Text Diffusion ModelBin Chen, Hao Wang, Xilin Zhang, Pinpin Zhu. 2712-2717 [doi]
- Organoid-ICLIP: Class Imbalance-Aware Vision-Language Learning for Organoid Mitosis ClassificationAnabia Sohail, Oishi Deb, Anwaar Ulhaq. 2718-2723 [doi]
- Polarization Denoising and Demosaicking: Dataset and Baseline MethodMuhamad Daniel Ariff Bin Abdul Rahman, Yusuke Monno, Masayuki Tanaka 0001, Masatoshi Okutomi. 2724-2729 [doi]
- Enhancing Multi-Task Learning with Attention MechanismsAtharva Diwan, Aaron Jerry Ninan, Longjiao Zhao, Jaechul Kim. 2730-2735 [doi]
- Astrophotography Turbulence Mitigation Via Generative ModelsJoonyeoup Kim, Yu Yuan, Xingguang Zhang, Xijun Wang, Stanley Chan. 2736-2741 [doi]
- TURBIT: Generating Turbid Underwater Images with Diffusion and Differential TransformersUtkarsh Srivastava, Soumajit Roy, Alik Pramanick, Arijit Sur. 2742-2747 [doi]
- Eyes and Ears: Automated Annotation of Audio Data Using Computer VisionGalane Basha Namomsa, Alex Gichamba, Brian Ebiyau, João Barros. 2748-2753 [doi]
- LargeSceneGaussian: High-Efficiency 3D Gaussian Splatting for Large-Scale Scene ReconstructionYifeng Ge, Junqi Liao, Li Li, Deke Tang. 2754-2759 [doi]
- Leveraging Depth Foundation Models in Self Supervised Monocular Depth EstimationAaron Jerry Ninan, Atharva Diwan, Longjiao Zhao, Jaechul Kim. 2760-2765 [doi]
- GHS-VDG:Graph and Hybrid Spatio-Temporal Attention for Video Diffusion GenerationGao Xinyu, Fang Du, Song Lijuan, Zhang Xu. 2766-2771 [doi]
- Ultrafast High-Flux Single-Photon Lidar Simulator via Neural MappingWeijian Zhang, Hashan K. Weerasooriya, Stanley H. Chan. 2772-2777 [doi]
- Bevanet: Bilateral Efficient Visual Attention Network for Real-Time Semantic SegmentationPing-Mao Huang, I-Tien Chao, Ping-Chia Huang, Jia-Wei Liao, Yung-Yu Chuang. 2778-2783 [doi]
- CGD-MAE: Clip Distillation-Driven Pre-Training Framework for Vehicle Re-IdentificationEurico Almeida, Bruno Silva, Alexandre Marques, Pedro Ferreira, Jorge P. Batista. 2784-2789 [doi]
- Transformer Augmented Multi-Resolution Hash Encoding in Diffusion Model for 3D Point Cloud DenoisingSeema Kumari, Utkarsh Mishra, Srimanta Mandal, Shanmuganathan Raman. 2790-2795 [doi]
- Improving Pseudo-Labels Selection Using Domain Priors for Semi-Supervised Detection in Capsule EndoscopyBidossessi Emmanuel Agossou, Marius Pedersen, Anuja Vats, Kiran B. Raja. 2796-2801 [doi]
- Zero-Shot Pseudo Labels Generation Using Sam and Clip for Semi-Supervised Semantic SegmentationNagito Saito, Shintaro Ito, Koichi Ito 0001, Takafumi Aoki. 2802-2807 [doi]
- BD Open LULC Map: High-Resolution Land Use Land Cover Mapping & Benchmarking For Urban Development In Dhaka, BangladeshMir Sazzat Hossain, Ovi Paul, Md. Akil Raihan Iftee, Rakibul Hasan Rajib, Abu Bakar Siddik Nayem, Anis Sarker, Arshad Momen, Md. Ashraful Amin, Amin Ahsan Ali, A. K. M. Mahbubur Rahman. 2808-2813 [doi]
- Beta Wavelet Induced Multi-Scale Kernel Clustering: A Frequency-Aware Framework for Complex Data AnalysisKerui Cheng, Yan Chen, Liang Du. 2814-2819 [doi]
- Generative Personalized Blind Face Restoration Enhanced by Physical IdentityXijun Wang, Xingguang Zhang, Yu Yuan, Bole Ma, Prateek Chennuri, Stanley Chan. 2820-2825 [doi]
- Anatomical Attention Alignment Representation for Radiology Report GenerationQuang Vinh Nguyen, Minh Duc Nguyen, Thanh Hoang Son Vo, Hyung Jeong Yang, Soo-Hyung Kim. 2826-2831 [doi]
- Enhancing Unsupervised Domain Adaptation in Semantic Segmentation Through Selective Consensus and Gaussian Mixture Model-Based Pseudo-LabelingPhuong Dong Tran, Hieu Nguyen, Thi-Oanh Nguyen. 2832-2837 [doi]
- Laplacian-Mamba: Mamba-Based Laplacian Pyramid Enhancement Network for Unpaired High-Definition ImagesZhiquan Mao, Mengning Yang. 2838-2843 [doi]
- Sparse2DGS: Sparse-View Surface Reconstruction Using 2D Gaussian Splatting with Dense Point CloudNatsuki Takama, Shintaro Ito, Koichi Ito 0001, Hwann-Tzong Chen, Takafumi Aoki. 2844-2849 [doi]
- ErpGS: Equirectangular Image Rendering Enhanced with 3D Gaussian RegularizationShintaro Ito, Natsuki Takama, Koichi Ito 0001, Hwann-Tzong Chen, Takafumi Aoki. 2850-2855 [doi]
- rPPG-NDCL: Unsupervised Remote Physiological Measurement Via Noise-Disentangled Contrastive LearningTianyang Dai, Yan Chen, Yang Hu. 2856-2861 [doi]
- DCM-VideoNet: A Densely-Connected Modulated Decoder Framework for Implicit Neural Video CompressionCih-Wei Wong, Hsu-Feng Hsiao. 2862-2867 [doi]
- RGC-Bent: A Novel Dataset for Bent Radio Galaxy ClassificationMir Sazzat Hossain, K. M. B. Asad, Payaswini Saikia, Adrita Khan, Md Akil Raihan Iftee, Rakibul Hasan Rajib, Arshad Momen, Md. Ashraful Amin, Amin Ahsan Ali, A. K. M. Mahbubur Rahman. 2868-2873 [doi]
- Can Large Language Models Challenge CNNs in Medical Image Analysis?Shibbir Ahmed, Shahnewaz Karim Sakib, Anindya Bijoy Das. 2874-2879 [doi]
- Lightweight Temporal Contextual Fine-Tuning Method of Large Multimodal Model for Video Moment RetrievalSemi Kwon, Ju-Hee Lee, Je-Won Kang. 2880-2885 [doi]
- Efficient Feature-Guided Approach for Image RestorationChan-Yu Wang, Tsung-Jung Liu, Kuan-Hsien Liu. 2886-2891 [doi]
- PawPrint: Whose Footprints are These? Identifying Animal Individuals by their FootprintsInpyo Song, Hyemin Hwang, Jangwon Lee. 2892-2897 [doi]