Autonomous Imagination: Closed-Loop Decomposition of Visual-to-Textual Conversion in Visual Reasoning for Multimodal Large Language Models

Jingming Liu(Henan University of Technology), Kun Zhou, Tianjia Shao, Yao-Xiang Ding, Bo Xiao, Yumeng Li(Changchun University of Science and Technology), Yu‐Cin Jian
arXiv (Cornell University)
November 27, 2024
Cited by 0


Related Papers