Multi-modality based future predictive representation learning for video anticipation captioning

Jiyeon Hwang, Suyoung Kim, Ho-Young Jung. Multi-modality based future predictive representation learning for video anticipation captioning. Appl. Soft Comput., 200:115420, 2026. [doi]

Abstract

Abstract is missing.