UniSpec: Training-Free Speculative Decoding for Robust LLM Acceleration Across Languages and Hardware

Truong Dinh Do, Nguyen-Khang Le, Le Minh Nguyen. UniSpec: Training-Free Speculative Decoding for Robust LLM Acceleration Across Languages and Hardware. In Maria Liakata, Viviane P. Moreira, Jiajun Zhang 0001, David Jurgens, editors, Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), ACL 2026, San Diego, California, United States, July 2-7, 2026. pages 6288-6310, Association for Computational Linguistics, 2026. [doi]

Abstract

Abstract is missing.