Gu, Shixiang
- Categorical Reparameterization with Gumbel-Softmax
2016/11/03 by Eric Jang, Jang, Eric, Shixiang Gu +3 · 423 citations
Computer Science · #Neural Networks and Applications #Generative Adversarial Networks and Image Synthesis #Computational Physics and Python Applications
- Data-Efficient Hierarchical Reinforcement Learning
2018/05/21 by Ofir Nachum, Nachum, Ofir, Shixiang Gu +5 · 66 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Adversarial Robustness in Machine Learning #Autonomous Vehicle Technology and Safety
- Leave no Trace: Learning to Reset for Safe and Autonomous Reinforcement Learning
2017/11/18 by Benjamin Eysenbach, Eysenbach, Benjamin, Shixiang Gu +5 · 1 voice · 8 citations
Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics #Robot Manipulation and Learning #cs.LG #cs.RO
- Deep Reinforcement Learning for Robotic Manipulation with Asynchronous Off-Policy Updates
2016/10/03 by Gu, Shixiang, Holly, Ethan, Lillicrap, Timothy +1 · 19 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
- Q-Prop: Sample-Efficient Policy Gradient with An Off-Policy Critic
2016/11/07 by Shixiang Gu, Timothy Lillicrap, Gu, Shixiang +7 · 28 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Fuel Cells and Related Materials #Advanced Neural Network Applications
- Dynamics-Aware Unsupervised Discovery of Skills
2019/07/02 by Archit Sharma, Sharma, Archit, Shixiang Gu +7 · 19 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Machine Learning and Data Classification #Reinforcement Learning in Robotics #Robotics (cs.RO)
- Way Off-Policy Batch Deep Reinforcement Learning of Implicit Human Preferences in Dialog
2019/06/30 by Jaques, Natasha, Ghandeharioun, Asma, Shen, Judy Hanwen +5 · 15 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Sequence Tutor: Conservative Fine-Tuning of Sequence Generation Models with KL-control
2016/11/09 by Jaques, Natasha, Gu, Shixiang, Bahdanau, Dzmitry +3 · 11 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- A Divergence Minimization Perspective on Imitation Learning Methods
2019/11/06 by Seyed Kamyar Seyed Ghasemipour, Ghasemipour, Seyed Kamyar Seyed, Richard S. Zemel +3 · 11 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Adversarial Robustness in Machine Learning #Robot Manipulation and Learning
- Temporal Difference Models: Model-Free Deep RL for Model-Based Control
2018/02/25 by Vitchyr H. Pong, Pong, Vitchyr, Shixiang Gu +5 · 13 citations
Computer Science · Energy · #Adaptive Dynamic Programming Control #Energy Efficiency and Management #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization
2020/06/05 by Tatsuya Matsushima, Hiroki Furuta, Matsushima, Tatsuya +7 · 11 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Modular Robots and Swarm Intelligence #Mobile Crowdsensing and Crowdsourcing
- Language as an Abstraction for Hierarchical Deep Reinforcement Learning
2019/06/18 by Yiding Jiang, Jiang, Yiding, Shixiang Gu +5 · 8 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Modular Robots and Swarm Intelligence
- Continuous Deep Q-Learning with Model-based Acceleration
2016/03/02 by Gu, Shixiang, Lillicrap, Timothy, Sutskever, Ilya +1 · 5 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Robotics (cs.RO) #Systems and Control (eess.SY) #electronic engineering #information engineering
- Why Does Hierarchy (Sometimes) Work So Well in Reinforcement Learning?
2019/09/23 by Ofir Nachum, Haoran Tang, Nachum, Ofir +9 · 8 citations
Business, Management and Accounting · Computer Science · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Supply Chain and Inventory Management
- Towards Deep Neural Network Architectures Robust to Adversarial Examples
2014/12/11 by Gu, Shixiang, Rigazio, Luca · 4 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural and Evolutionary Computing (cs.NE)
- Near-Optimal Representation Learning for Hierarchical Reinforcement\n Learning
2018/10/02 by Ofir Nachum, Shixiang Gu, Nachum, Ofir +5 · 4 citations
Biochemistry, Genetics and Molecular Biology · Computer Science · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Zebrafish Biomedical Research Applications
- Multi-Agent Manipulation via Locomotion using Hierarchical Sim2Real
2019/08/13 by Nachum, Ofir, Ahn, Michael, Ponte, Hugo +2 · 4 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
- Emergent Real-World Robotic Skills via Unsupervised Off-Policy Reinforcement Learning
2020/04/27 by Sharma, Archit, Ahn, Michael, Levine, Sergey +3 · 4 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
- Neural Adaptive Sequential Monte Carlo
2015/06/10 by Gu, Shixiang, Ghahramani, Zoubin, Turner, Richard E. · 3 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Interpolated Policy Gradient: Merging On-Policy and Off-Policy Gradient Estimation for Deep Reinforcement Learning
2017/06/01 by Gu, Shixiang, Lillicrap, Timothy, Ghahramani, Zoubin +3 · 3 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
- MuProp: Unbiased Backpropagation for Stochastic Neural Networks
2015/11/16 by Gu, Shixiang, Levine, Sergey, Sutskever, Ilya +1 · 2 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- The Mirage of Action-Dependent Baselines in Reinforcement Learning
2018/02/27 by Tucker, George, Bhupatiraju, Surya, Gu, Shixiang +3 · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Doubly Reparameterized Gradient Estimators for Monte Carlo Objectives
2018/10/09 by Tucker, George, Lawson, Dieterich, Gu, Shixiang +1 · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)