Abstract is missing.
- Robust Phase Retrieval from Quantized and Noisy MeasurementsYihong Gao, Luteng Zhu, Zhuoyang An, Mingjie Shao. 1-5 [doi]
- Enhancing and Exploring Mild Cognitive Impairment Detection with W2V-BERT-2.0Yueguan Wang, Tatsunari Matsushima, Soichiro Matsushima, Toshimitsu Sakai. 1-5 [doi]
- Discrete Speech Unit Extraction via Independent Component AnalysisTomohiko Nakamura, KwangHee Choi, Keigo Hojo, Yoshiaki Bando, Satoru Fukayama, Shinji Watanabe 0001. 1-5 [doi]
- PAWS: A Physical Acoustic Wave Simulation Dataset for Sound Modeling and RenderingTianming Yin, Yiyang Zhou, Xuzhou Ye, Qiuqiang Kong. 1-5 [doi]
- USMID: A Unimodal Speaker-Level Membership Inference Detector for Contrastive PretrainingRuoxi Cheng, Yizhong Ding, Shuirong Cao, Shitong Shao, Zhiqiang Wang. 1-5 [doi]
- Leveraging LLM and Text-Queried Separation for Noise-Robust Sound Event DetectionHan Yin, Yang Xiao, Jisheng Bai, Rohan Kumar Das. 1-5 [doi]
- Investigating the Effectiveness of Explainability Methods in Parkinson's Detection from SpeechEleonora Mancini, Francesco Paissan, Paolo Torroni, Mirco Ravanelli, Cem Subakan. 1-5 [doi]
- Hybrid Quantum Machine Learning based Human Speech Emotion RecognitionSparsh Mittal, Yash Chand, Mintu Kumar, Neel Kanth Kundu. 1-5 [doi]
- Investigating Temporal Convolutional Networks for Automated Stroke Transcription in the MridangamGopika Krishnan, Akshay Anantapadmanabhan, Kaustuv Kanti Ganguli, Carlos Guedes. 1-5 [doi]
- Transfer Learning Analysis of Variational Quantum CircuitsHuan-Hsin Tseng, Hsin-Yi Lin, Samuel Yen-Chi Chen, Shinjae Yoo. 1-5 [doi]
- Quantum Kernel-Based Long Short-term MemoryYu-Chao Hsu, Tai-Yu Li, Kuan-Cheng Chen. 1-5 [doi]
- Exploring the Complexity of Parkinson's Patient Speech for Depression Detection task: A Qualitative AnalysisBarbara Ruvolo, Tilak Purohit, Bogdan Vlasenko, Juan Rafael Orozco-Arroyave, Mathew Magimai-Doss. 1-5 [doi]
- Hybrid Encoding-based Quantum Self Attention for Financial Time Series AnalysisLokes S, Suresh Reddy, Samuel Yen-Chi Chen. 1-5 [doi]
- StableTTS: Towards Efficient Denoising Acoustic Decoder for Text to Speech Synthesis with Consistency Flow MatchingZhiyong Chen, Xinnuo Li, Shuhang Wu, Zhi Yang, Zhiqi Ai, Shugong Xu. 1-5 [doi]
- IndicST: Indian Multilingual Translation Corpus For Evaluating Speech Large Language ModelsSanket Shah, Kavya Ranjan Saxena, Kancharana Manideep Bharadwaj, Sharath Adavanne, Nagaraj Adiga. 1-5 [doi]
- Generative Data Augmentation Challenge: Synthesis of Room Acoustics for Speaker Distance EstimationJackie Lin, Georg Götz, Hermes Sampedro Llopis, Haukur Hafsteinsson, Steinar Guðjónsson, Daniel Gert Nielsen, Finnur Pind, Paris Smaragdis, Dinesh Manocha, John R. Hershey, Trausti T. Kristjansson, Minje Kim. 1-5 [doi]
- CompressedMediQ: Hybrid Quantum Machine Learning Pipeline for High-Dimensional Neuroimaging DataKuan-Cheng Chen, Yi-Tien Li, Tai-Yu Li, Chen-yu Liu, Po-Heng Henry Lee, Cheng-Yu Chen. 1-5 [doi]
- Gamaka Synthesis for Kalpitha Swaras in Carnatic MusicRaghavasimhan Sankaranarayanan, Larry Heck, Gil Weinberg. 1-5 [doi]
- Speech-based Clinical Depression Detection: An Empirical StudyYangbin Chen, Chenyang Xu, Chunfeng Liang, Yanbao Tao, Chuan Shi 0006. 1-5 [doi]
- Thoughts on Mapping and Interface Design of a Keyboard to Perform Continuous Pitch Ornamentations in Hindustani MusicNinad Puranik, Travis J. West, Marcelo M. Wanderley, Gary P. Scavone. 1-5 [doi]
- Learning to Measure Quantum Neural NetworksSamuel Yen-Chi Chen, Huan-Hsin Tseng, Hsin-Yi Lin, Shinjae Yoo. 1-5 [doi]
- Computation Overhead Optimization Dual-Domain Network with Multi-Level Cross-Domain Connections for Sparse-view CT ReconstructionZihan Deng, Zhisheng Wang, Shanyuan Lin, Guohang He, Demin Jiang, Shunli Wang 0004. 1-5 [doi]
- Investigating the Effects of Diffusion-based Conditional Generative Speech Models Used for Speech Enhancement on Dysarthric SpeechJoanna Reszka, Parvaneh Janbakhshi, Tilak Purohit, Sadegh Mohammadi 0003. 1-5 [doi]
- Quantum Neural Network Extraction Attack via Split Co-TeachingZhenxiao Fu, Fan Chen 0001. 1-5 [doi]
- Deep Meta Advisor-aided Exploration for UAV Trajectory Design in Vehicular NetworksLeonardo Spampinato, Enrico Testi, Chiara Buratti, Riccardo Marini. 1-5 [doi]
- Mind the Prompt: Prompting Strategies in Audio Generations for Improving Sound ClassificationFrancesca Ronchini, Ho-Hsiang Wu, Wei-Cheng Lin, Fabio Antonacci. 1-5 [doi]
- Distributed ADMM for Target Localization using Radar NetworksSrikar Chaganti, Francesco Fioranelli, Raj Thilak Rajan. 1-5 [doi]
- Singing Voice Accompaniment Data Augmentation with Generative ModelsMiguel Perez, Holger Kirchhoff, Peter Grosche, Xavier Serra. 1-5 [doi]
- HARP: A Large-Scale Higher-Order Ambisonic Room Impulse Response DatasetShivam Saini, Jürgen Peissig. 1-5 [doi]
- Transformer-based Distributed Machine Learning for Downlink Channel Estimation in RIS-Aided NetworksMuhammad Ahmed Mohsin, Syed Muhammad Jameel, Hassan Rizwan, Muhammad Iqbal, Tabinda Ashraf, Jen-Yi Pan. 1-5 [doi]
- Unsupervised Rhythm and Voice Conversion of Dysarthric to Healthy Speech for ASRKarl El Hajal, Enno Hermann, Ajinkya Kulkarni, Mathew Magimai-Doss. 1-5 [doi]
- Closing the Loop on Speech to Music Translation: Automatically Generating Synthetic Percussive Sequences on the Mridangam from KonnakolGopika Krishnan, Julia Drabek, Akshay Anantapadmanabhan, Kaustuv Kanti Ganguli, Carlos Guedes. 1-5 [doi]
- MACE: Leveraging Audio for Evaluating Audio Captioning SystemsSatvik Dixit, Soham Deshmukh, Bhiksha Raj. 1-5 [doi]
- Multi-Armed Bandit with Sparse and Noisy FeedbackDjallel Bouneffouf 0001, Raphaël Féraud, Baihan Lin. 1-5 [doi]
- Agnostic Automatic Melodic Accompaniment for Alapana in Carnatic MusicRaghavasimhan Sankaranarayanan, Gil Weinberg. 1-5 [doi]
- Fusion Strategies in Multiple Particle Filtering in the Presence of Shared Unknown Static ParametersXiaokun Zhao, Marija Iloska, Mónica F. Bugallo. 1-5 [doi]
- On Investigating a Better Audio Representation for Mood Classification in Indian Popular MusicArathi K, Hotha Durga Swetha, V. G. Vaishali, Kalyan Munukutla, Abhijith V, Gurram Shalini, Joe Cheri Ross. 1-5 [doi]
- Disentangling Overlapping Sources: Improving Vocal and Violin Source Separation in Carnatic MusicAdithi Shankar, Serafin Schweinitz, Genís Plaja-Roglans, Xavier Serra, Martín Rocamora. 1-5 [doi]
- Confidence-Enhanced Models for Indian Art Music AnalysisSumit Kumar, Parampreet Singh, Vipul Arora 0001. 1-5 [doi]
- A Notation Dataset for Indian Raga MusicSoham Korade, Suswara Pochampally. 1-5 [doi]
- Class-Incremental Learning for Sound Event Localization and DetectionRuchi Pandey, Manjunath Mulimani, Archontis Politis, Annamaria Mesaros. 1-5 [doi]
- Assessing Model Proficiency in Autonomous Agents: A Signal Processing PerspectiveA. Guerra, Francesco Guidi, Davide Dardari, Petar M. Djuric. 1-5 [doi]
- Low-Complexity Algorithms for Multichannel Spectral Super-ResolutionXunmeng Wu, Zai Yang, ZongBen Xu. 1-5 [doi]
- Musimple: A Simplified Music Generation System with Diffusion TransformerZheqi Dai, Haolin He, Qiuqiang Kong. 1-5 [doi]
- Generalized Constructions of Weight-Constrained Sparse ArraysPranav Kulkarni, P. P. Vaidyanathan. 1-5 [doi]
- Quantum-Trained Convolutional Neural Network for Deepfake Audio DetectionChu-Hsuan Abraham Lin, Chen-yu Liu, Samuel Yen-Chi Chen, Kuan-Cheng Chen. 1-5 [doi]
- Parkinson's Disease Detection Using Wavelet Packet Absolute Amplitude Deviation (WPAAD) from voice signalsPandit Vivek Kumar Pandey, Sitanshu Sekhar Sahu, Biswajit Karan, Juan Rafael Orozco-Arroyave. 1-5 [doi]
- Svara-Forms in Carnatic Music: Contextual Influences on the Performance of SvaraThomas Nuttall, Xavier Serra, Lara Pearson. 1-5 [doi]
- Consensus-based Distributed Quantum Kernel Learning for Speech RecognitionKuan-Cheng Chen, Wenxuan Ma 0007, Xiaotian Xu. 1-5 [doi]
- Word and Text Similarity Using Classical Word Embeddings in Quantum NLP SystemsDamir Cavar, Koushik Reddy Parukola. 1-5 [doi]
- Pathological Voice Detection From Sustained Vowels: Handcrafted vs. Self-supervised LearningBagus Tris Atmaja, Akira Sasou. 1-5 [doi]
- AI/ML-driven beamforming with imperfect channel state information for multi-user MIMO transmissionHamed Farhadi, Prayag Gowgi, David Sandberg. 1-5 [doi]
- TSPE: Task-Specific Prompt Ensemble for Improved Zero-Shot Audio ClassificationNishit Anand, Ashish Seth, Ramani Duraiswami, Dinesh Manocha. 1-5 [doi]
- Adaptive Waveform Design for Cognitive MIMO ISACD. Patel, Joseph Tabrikian, Igal Bilik. 1-5 [doi]
- Near-Field WPT Using Multisine Phase Alignment and Massive Antenna Array at Extreme FrequenciesAyush Kumar Dwivedi, Taneli Riihonen. 1-4 [doi]
- 3D Gaussian Splatting with Normal Information for Mesh Extraction and Improved RenderingMeenakshi Krishnan, Liam Fowl, Ramani Duraiswami. 1-5 [doi]
- Prosody Disentanglement with Self-Supervised Speech Representation for Detecting DepressionBubai Maji, Rajlakshmi Guha, Aurobinda Routray, Shazia Nasreen, Debabrata Majumdar. 1-5 [doi]
- Expressive Timing in Hindustani Vocal MusicYash Bhake, Preeti Rao. 1-5 [doi]
- Generative Data Augmentation Challenge: Zero-Shot Speech Synthesis for Personalized Speech EnhancementJae-Sung Bae, Anastasia Kuznetsova, Dinesh Manocha, John R. Hershey, Trausti T. Kristjansson, Minje Kim. 1-5 [doi]
- Computational Analysis and Classification of the Pannisai system of Indian Classical MusicV. T. Balamurugan, J. Hrithick Sundar, V. V. Meenakshi. 1-4 [doi]
- Speech-Based Estimation of Schizophrenia Severity Using Feature FusionGowtham Premananth, Carol Y. Espy-Wilson. 1-5 [doi]
- Performance Evaluation of SLAM-ASR: The Good, the Bad, the Ugly, and the Way ForwardShashi Kumar, Iuliia Thorbecke, Sergio Burdisso, Esaú Villatoro-Tello, Manjunath K. E, Kadri Hacioglu, Pradeep Rangappa, Petr Motlícek, Aravind Ganapathiraju, Andreas Stolcke. 1-5 [doi]
- Non-linear Variational Bayes Multiple Model for Positioning in Highway TunnelMarco Piavanini, Simone Specchia, Mattia Brambilla, Sergio Matteo Savaresi, Monica Nicoli. 1-5 [doi]
- Federated Semi-supervised Learning for Industrial Sound Analysis and Keyword SpottingSascha Grollmisch, Thomas Köllmer, Artem Yaroshchuk, Hanna M. Lukashevich. 1-5 [doi]