Visual Prompting in Multimodal Large Language Models: A Survey

Junda Wu(University of California San Diego), Julian McAuley(University of California San Diego), Lina Yao(Zhengzhou University), Jingbo Shang(University of Illinois Urbana-Champaign), Dimitris Metaxas(Rutgers Sexual and Reproductive Health and Rights), S. Mitra(University of California, Santa Barbara), Aaron N. Chang(Baylor University Medical Center), Zhehao Zhang, Yu Xia(Wenzhou Medical University), Sungchul Kim(Adobe Systems (United States)), Tong Yu(Adobe Systems (United States)), Ruiyi Zhang, Ryan A. Rossi(Adobe Systems (United States)), Xintong Li, Zhaoyang Xia(Rutgers, The State University of New Jersey)
arXiv (Cornell University)
September 5, 2024
Cited by 4


Related Papers