vix.ing · top · new · best · stats · spec

Pierre‐Luc Bacon

  1. Conditional Computation in Neural Networks for faster models
    2015/11/19 by Emmanuel Bengio, Pierre‐Luc Bacon, Bengio, Emmanuel +5 · 32 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Machine Learning and Algorithms #Advanced Neural Network Applications
  2. When Do Transformers Shine in RL? Decoupling Memory from Credit Assignment
    2023/07/07 by Tianwei Ni, Ni, Tianwei, Michel Ma +5 · 8 citations
    Computer Science · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Software Engineering Research
  3. When Waiting is not an Option : Learning Options with a Deliberation\n Cost
    2017/09/13 by Jean Harb, Harb, Jean, Pierre‐Luc Bacon +5 · 4 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Reinforcement Learning in Robotics
  4. MaestroMotif: Skill Design from Artificial Intelligence Feedback
    2024/12/11 by Martin Klissarov, Mikael Henaff, Klissarov, Martin +21 · 1 voice · 8 citations
    Business, Management and Accounting · #AI and HR Technologies #cs.AI #cs.CL #cs.LG
  5. Bridging State and History Representations: Understanding Self-Predictive RL
    2024/01/17 by Tianwei Ni, Ni, Tianwei, Benjamin Eysenbach +11 · 7 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Topic Modeling
  6. Control-Oriented Model-Based Reinforcement Learning with Implicit Differentiation
    2021/06/06 by Evgenii Nikishin, Romina Abachi, Nikishin, Evgenii +5 · 3 citations
    Computer Science · Decision Sciences · Economics, Econometrics and Finance · #Artificial Intelligence (cs.AI) #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Sports Analytics and Performance
  7. Neural Algorithmic Reasoners are Implicit Planners
    2021/10/11 by Andreea Deac, Petar Veličković, Deac, Andreea +9 · 2 citations
    Computer Science · #Reinforcement Learning in Robotics #AI-based Problem Solving and Planning #Neural Networks and Applications
  8. Goal-conditioned GFlowNets for Controllable Multi-Objective Molecular Design
    2023/06/07 by Julien Roy, Roy, Julien, Pierre‐Luc Bacon +5 · 2 citations
    Computer Science · Engineering · Materials Science · #Biomolecules (q-bio.BM) #Computational Drug Discovery Methods #FOS: Biological sciences #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning in Materials Science #Process Optimization and Integration
  9. Learnings Options End-to-End for Continuous Action Tasks
    2017/11/30 by Martin Klissarov, Klissarov, Martin, Pierre‐Luc Bacon +5 · 1 citation
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Auction Theory and Applications
  10. Options of Interest: Temporal Abstraction with Interest Functions
    2020/01/01 by Khimya Khetarpal, Martin Klissarov, Khetarpal, Khimya +7 · 1 citation
    Computer Science · Engineering · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Control Systems Optimization #Auction Theory and Applications
  11. Policy Evaluation Networks
    2020/02/26 by Jean Harb, Harb, Jean, Tom Schaul +5 · 1 citation
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Infrastructure Resilience and Vulnerability Analysis #Machine Learning and Algorithms
  12. XLVIN: eXecuted Latent Value Iteration Nets
    2020/10/25 by Andreea Deac, Deac, Andreea, Petar Veličković +9 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics
  13. An Information-Theoretic Perspective on Credit Assignment in Reinforcement Learning
    2021/03/10 by Dilip Arumugam, Peter Henderson, Arumugam, Dilip +3 · 1 citation
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Information Theory (cs.IT) #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Smart Grid Energy Management
  14. Continuous-Time Meta-Learning with Forward Mode Differentiation
    2022/03/02 by Tristan Deleu, David Kanaa, Deleu, Tristan +11 · 1 citation
    Computer Science · #Domain Adaptation and Few-Shot Learning
  15. Maxwell's Demon at Work: Efficient Pruning by Leveraging Saturation of Neurons
    2024/03/12 by Simon Dufort-Labbé, Dufort-Labbé, Simon, Pierluca D’Oro +9 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural Networks and Applications
  16. Understanding the Curse of Horizon in Off-Policy Evaluation via Conditional Importance Sampling
    2019/10/15 by Yao Liu, Pierre‐Luc Bacon, Liu, Yao +3 · 1 citation
    Economics, Econometrics and Finance · Mathematics · #Advanced Causal Inference Techniques #Economic Policies and Impacts #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Statistical Methods and Inference
  17. State Entropy Regularization for Robust Reinforcement Learning
    2025/06/08 by Yonatan Ashlag, Uri Koren, Ashlag, Yonatan +9 · 2 citations
    Computer Science · #Reinforcement Learning in Robotics #Adversarial Robustness in Machine Learning #Adaptive Dynamic Programming Control