Embodied VideoAgent: Persistent Memory from Egocentric Videos and Embodied Sensors Enables Dynamic Scene Understanding

Yue Fan, Xiaojian Ma 0001, Rongpeng Su, Jun Guo 0009, Rujie Wu, Xi Chen, Qing Li 0003. Embodied VideoAgent: Persistent Memory from Egocentric Videos and Embodied Sensors Enables Dynamic Scene Understanding. In IEEE/CVF International Conference on Computer Vision, ICCV 2025, Honolulu, HI, USA, October 19-25, 2025. pages 6342-6352, IEEE, 2025. [doi]

Abstract

Abstract is missing.