Convergence and stability analysis of value iteration Q-learning under non-discounted cost for discrete-time optimal controlShijie Song, Minglei Zhu, Mingming Zhao et al.|Neurocomputing|2024Cited by 5