Cameron Foale
- Multi-objective Reinforcement Learning With Augmented States Requires Rewards After Deployment
2026/04/17 by Peter Vamplew, Cameron Foale · 1 voice
Computer Science · Decision Sciences · #Adaptive Dynamic Programming Control #Advanced Bandit Algorithms Research #Function (biology) #Proxy (statistics) #Q-learning #Reinforcement #Reinforcement Learning in Robotics #Reinforcement learning #Software deployment #State (computer science) #cs.LG
- ES-C51: Expected sarsa based C51 distributional reinforcement learning algorithm
2026/06/13 by Rijul Tandon, Peter Vamplew, Cameron Foale · 1 voice
Computer Science · #Adaptive Dynamic Programming Control #Artificial Intelligence in Games #Reinforcement Learning in Robotics