Convergence and stability analysis of value iteration Q-learning under non-discounted cost for discrete-time optimal control
Shijie Song(Southwest Jiaotong University), Minglei Zhu(Southwest Jiaotong University), Mingming Zhao(Guangxi Academy of Sciences), Dawei Gong(University of Electronic Science and Technology of China)
Cited by 5
Related Papers
The intelligent critic framework for advanced optimal control
|Artificial Intelligence Review|2022|189
Impacts of urea N addition on soil microbial community in a semi-arid temperate steppe in northern China
|Plant and Soil|2008|150
Anaerobic digestion using ultrasound as pretreatment approach: Changes in waste activated sludge, anaerobic digestion performances and digestive microbial populations
|Biochemical Engineering Journal|2017|124
Adaptive Multi-Step Evaluation Design With Stability Guarantee for Discrete-Time Optimal Learning Control
|IEEE/CAA Journal of Automatica Sinica|2023|118
Dual Event-Triggered Constrained Control Through Adaptive Critic for Discrete-Time Zero-Sum Games
|IEEE Transactions on Systems Man and Cybernetics Systems|2022|112