José Luis Huillca Mango, Leandro A. F. Fernandes. Multimodal Embedding for Scientific Image Caption Generation. In Antonino Furnari, Petia Radeva, editors, Proceedings of the 21st International Conference on Computer Vision Theory and Applications, VISAPP 2026, Marbella, Spain, March 9-11, 2026, Volume 1. pages 87-98, SCITEPRESS, 2026. [doi]
@inproceedings{MangoF26,
title = {Multimodal Embedding for Scientific Image Caption Generation},
author = {José Luis Huillca Mango and Leandro A. F. Fernandes},
year = {2026},
doi = {10.5220/0014338800004084},
url = {https://doi.org/10.5220/0014338800004084},
researchr = {https://researchr.org/publication/MangoF26},
cites = {0},
citedby = {0},
pages = {87-98},
booktitle = {Proceedings of the 21st International Conference on Computer Vision Theory and Applications, VISAPP 2026, Marbella, Spain, March 9-11, 2026, Volume 1},
editor = {Antonino Furnari and Petia Radeva},
publisher = {SCITEPRESS},
isbn = {978-989-758-804-4},
}