MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning

Jun Chen(Liaoning Technical University), Mohamed Elhoseiny(King Abdullah University of Science and Technology), Raghuraman Krishnamoorthi, Pengchuan Zhang(Greentech (France)), Deyao Zhu, Zechun Liu, Yunyang Xiong(University of Wisconsin–Madison), Vikas Chandra(Meta (Israel)), Xiang Li, Xiaoqian Shen
arXiv (Cornell University)
October 14, 2023
Cited by 66


Related Papers