Zhao, Stephen
- Maximum Entropy Gain Exploration for Long Horizon Multi-goal Reinforcement Learning
2020/07/06 by Pitis, Silviu, Chan, Harris, Zhao, Stephen +2 · 8 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Robotics (cs.RO)
- Probabilistic Inference in Language Models via Twisted Sequential Monte Carlo
2024/04/26 by Rob Brekelmans, Zhao, Stephen, Brekelmans, Rob +4 · 8 citations
Computer Science · #Natural Language Processing Techniques #Topic Modeling #Speech Recognition and Synthesis
- Proximal Learning With Opponent-Learning Awareness
2022/10/18 by Zhao, Stephen, Lu, Chris, Grosse, Roger Baker +1 · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA)