Prashansa Panda
- Two-Timescale Critic-Actor for Average Reward MDPs with Function Approximation
2024/02/02 by Prashansa Panda, Shalabh Bhatnagar, Panda, Prashansa +1 · 2 citations
Decision Sciences · #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG)