When Can We Trust LLM Graders? Calibrating Confidence for Automated Assessment

Robinson Ferrer, Damla Turgut, Zhongzhou Chen, Shashank Sonkar. When Can We Trust LLM Graders? Calibrating Confidence for Automated Assessment. In Emmanuel G. Blanchard, Guanliang Chen, Min Chi, Seiji Isotani, editors, Artificial Intelligence in Education - 27th International Conference, AIED 2026, Seoul, South Korea, June 27-July 3, 2026, Proceedings, Part I. Volume 16581 of Lecture Notes in Computer Science, pages 385-399, Springer, 2026. [doi]

Abstract

Abstract is missing.