Domain Specific Benchmarks for Evaluating Multimodal Large Language ModelsKhizar Anjum, Sakib Shahriar, Kadhim Hayawi et al.|Preprints.org|2025Cited by 4