PolyAudio: Advancing Multi-Audio Reasoning in Large Audio Language Models with Interleaved Multi-Audio Contexts

Sonal Kumar, Sreyan Ghosh, Yueqian Lin, S. Sakshi, Ashish Seth, Yiran Chen 0001, Ramani Duraiswami, Dinesh Manocha. PolyAudio: Advancing Multi-Audio Reasoning in Large Audio Language Models with Interleaved Multi-Audio Contexts. In Maria Liakata, Viviane P. Moreira, Jiajun Zhang 0001, David Jurgens, editors, Findings of the Association for Computational Linguistics, ACL 2026, San Diego, California, United States, July 2-7, 2026. pages 42335-42353, Association for Computational Linguistics, 2026. [doi]

@inproceedings{KumarGLSSCDM26,
  title = {PolyAudio: Advancing Multi-Audio Reasoning in Large Audio Language Models with Interleaved Multi-Audio Contexts},
  author = {Sonal Kumar and Sreyan Ghosh and Yueqian Lin and S. Sakshi and Ashish Seth and Yiran Chen 0001 and Ramani Duraiswami and Dinesh Manocha},
  year = {2026},
  url = {https://aclanthology.org/2026.findings-acl.2101/},
  researchr = {https://researchr.org/publication/KumarGLSSCDM26},
  cites = {0},
  citedby = {0},
  pages = {42335-42353},
  booktitle = {Findings of the Association for Computational Linguistics, ACL 2026, San Diego, California, United States, July 2-7, 2026},
  editor = {Maria Liakata and Viviane P. Moreira and Jiajun Zhang 0001 and David Jurgens},
  publisher = {Association for Computational Linguistics},
  isbn = {979-8-89176-395-1},
}