Autonomous Imagination: Closed-Loop Decomposition of Visual-to-Textual Conversion in Visual Reasoning for Multimodal Large Language ModelsJingming Liu, Kun Zhou, Bo Xiao et al.|arXiv (Cornell University)|2024Cited by 0