vix.ing
·
top
·
new
·
best
·
stats
·
spec
OnActor-Critic Algorithms
2003/01/01 by
Vijay R. Konda
,
John N. Tsitsiklis
· 5 citations
paper
· doi:10.1137/s0363012901385691
Cited by
Jointly Optimal Policies for Remote Estimation of Autoregressive Markov Processes over Time-Correlated Fading Channel
Control Synthesis of Cyber-Physical Systems for Real-Time Specifications through Causation-Guided Reinforcement Learning
Finite Time Analysis of Constrained Natural Critic-Actor Algorithm with Improved Sample Complexity
Convergence of regularized agent-state-based Q-learning in POMDPs
Finite-Time Global Optimality Convergence in Deep Neural Actor-Critic Methods for Decentralized Multi-Agent Reinforcement Learning