vix.ing · top · new · best · stats · spec

Gu, Shixiang

  1. Categorical Reparameterization with Gumbel-Softmax
    2016/11/03 by Eric Jang, Jang, Eric, Shixiang Gu +3 · 423 citations
    Computer Science · #Neural Networks and Applications #Generative Adversarial Networks and Image Synthesis #Computational Physics and Python Applications
  2. Data-Efficient Hierarchical Reinforcement Learning
    2018/05/21 by Ofir Nachum, Nachum, Ofir, Shixiang Gu +5 · 66 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Adversarial Robustness in Machine Learning #Autonomous Vehicle Technology and Safety
  3. Leave no Trace: Learning to Reset for Safe and Autonomous Reinforcement Learning
    2017/11/18 by Benjamin Eysenbach, Eysenbach, Benjamin, Shixiang Gu +5 · 1 voice · 8 citations
    Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics #Robot Manipulation and Learning #cs.LG #cs.RO
  4. Deep Reinforcement Learning for Robotic Manipulation with Asynchronous Off-Policy Updates
    2016/10/03 by Gu, Shixiang, Holly, Ethan, Lillicrap, Timothy +1 · 19 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  5. Q-Prop: Sample-Efficient Policy Gradient with An Off-Policy Critic
    2016/11/07 by Shixiang Gu, Timothy Lillicrap, Gu, Shixiang +7 · 28 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Fuel Cells and Related Materials #Advanced Neural Network Applications
  6. Dynamics-Aware Unsupervised Discovery of Skills
    2019/07/02 by Archit Sharma, Sharma, Archit, Shixiang Gu +7 · 19 citations
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Machine Learning and Data Classification #Reinforcement Learning in Robotics #Robotics (cs.RO)
  7. Way Off-Policy Batch Deep Reinforcement Learning of Implicit Human Preferences in Dialog
    2019/06/30 by Jaques, Natasha, Ghandeharioun, Asma, Shen, Judy Hanwen +5 · 15 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  8. Sequence Tutor: Conservative Fine-Tuning of Sequence Generation Models with KL-control
    2016/11/09 by Jaques, Natasha, Gu, Shixiang, Bahdanau, Dzmitry +3 · 11 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  9. A Divergence Minimization Perspective on Imitation Learning Methods
    2019/11/06 by Seyed Kamyar Seyed Ghasemipour, Ghasemipour, Seyed Kamyar Seyed, Richard S. Zemel +3 · 11 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Adversarial Robustness in Machine Learning #Robot Manipulation and Learning
  10. Temporal Difference Models: Model-Free Deep RL for Model-Based Control
    2018/02/25 by Vitchyr H. Pong, Pong, Vitchyr, Shixiang Gu +5 · 13 citations
    Computer Science · Energy · #Adaptive Dynamic Programming Control #Energy Efficiency and Management #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  11. Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization
    2020/06/05 by Tatsuya Matsushima, Hiroki Furuta, Matsushima, Tatsuya +7 · 11 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Modular Robots and Swarm Intelligence #Mobile Crowdsensing and Crowdsourcing
  12. Language as an Abstraction for Hierarchical Deep Reinforcement Learning
    2019/06/18 by Yiding Jiang, Jiang, Yiding, Shixiang Gu +5 · 8 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Modular Robots and Swarm Intelligence
  13. Continuous Deep Q-Learning with Model-based Acceleration
    2016/03/02 by Gu, Shixiang, Lillicrap, Timothy, Sutskever, Ilya +1 · 5 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Robotics (cs.RO) #Systems and Control (eess.SY) #electronic engineering #information engineering
  14. Why Does Hierarchy (Sometimes) Work So Well in Reinforcement Learning?
    2019/09/23 by Ofir Nachum, Haoran Tang, Nachum, Ofir +9 · 8 citations
    Business, Management and Accounting · Computer Science · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Supply Chain and Inventory Management
  15. Towards Deep Neural Network Architectures Robust to Adversarial Examples
    2014/12/11 by Gu, Shixiang, Rigazio, Luca · 4 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural and Evolutionary Computing (cs.NE)
  16. Near-Optimal Representation Learning for Hierarchical Reinforcement\n Learning
    2018/10/02 by Ofir Nachum, Shixiang Gu, Nachum, Ofir +5 · 4 citations
    Biochemistry, Genetics and Molecular Biology · Computer Science · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Zebrafish Biomedical Research Applications
  17. Multi-Agent Manipulation via Locomotion using Hierarchical Sim2Real
    2019/08/13 by Nachum, Ofir, Ahn, Michael, Ponte, Hugo +2 · 4 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  18. Emergent Real-World Robotic Skills via Unsupervised Off-Policy Reinforcement Learning
    2020/04/27 by Sharma, Archit, Ahn, Michael, Levine, Sergey +3 · 4 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  19. Neural Adaptive Sequential Monte Carlo
    2015/06/10 by Gu, Shixiang, Ghahramani, Zoubin, Turner, Richard E. · 3 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  20. Interpolated Policy Gradient: Merging On-Policy and Off-Policy Gradient Estimation for Deep Reinforcement Learning
    2017/06/01 by Gu, Shixiang, Lillicrap, Timothy, Ghahramani, Zoubin +3 · 3 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  21. MuProp: Unbiased Backpropagation for Stochastic Neural Networks
    2015/11/16 by Gu, Shixiang, Levine, Sergey, Sutskever, Ilya +1 · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  22. The Mirage of Action-Dependent Baselines in Reinforcement Learning
    2018/02/27 by Tucker, George, Bhupatiraju, Surya, Gu, Shixiang +3 · 1 citation
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  23. Doubly Reparameterized Gradient Estimators for Monte Carlo Objectives
    2018/10/09 by Tucker, George, Lawson, Dieterich, Gu, Shixiang +1 · 1 citation
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)