Haoxiang Sun, Yingqian Min, Zhipeng Chen 0001, Xin Zhao 0018, Ji-Rong Wen. Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models. In Maria Liakata, Viviane P. Moreira, Jiajun Zhang 0001, David Jurgens, editors, Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), ACL 2026, San Diego, California, United States, July 2-7, 2026. pages 17438-17457, Association for Computational Linguistics, 2026. [doi]
Abstract is missing.