When LLaVA Meets Objects: Token Composition for Vision-Language-ModelsSoumya Jahagirdar, Hilde Kuehne, Walid Bousselham et al.|Zenodo (CERN European Organization for Nuclear Research)|2026Cited by 0
When LLaVA Meets Objects: Token Composition for Vision-Language-ModelsSoumya Jahagirdar, Hilde Kuehne, Walid Bousselham et al.|arXiv (Cornell University)|2026Cited by 0
DEX-AR: A Dynamic Explainability Method for Autoregressive Vision-Language ModelsWalid Bousselham, Hilde Kuehne, Angie Boggust et al.|Open MIND|2026Cited by 0
DEX-AR: A Dynamic Explainability Method for Autoregressive Vision-Language ModelsWalid Bousselham, Hilde Kuehne, Angie Boggust et al.|arXiv (Cornell University)|2026Cited by 0