Pierre-Luc Bacon
- The Option-Critic Architecture
2016/09/16 by Pierre-Luc Bacon, Jean Harb, Bacon, Pierre-Luc +3 · 64 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #cs.AI
- Conditional Computation in Neural Networks for faster models
2015/11/19 by Emmanuel Bengio, Pierre‐Luc Bacon, Pierre-Luc Bacon +7 · 62 citations
Computer Science · #Advanced Neural Network Applications #Adversarial Robustness in Machine Learning #Machine Learning and Algorithms #cs.LG
- The Primacy Bias in Deep Reinforcement Learning
2022/05/16 by Evgenii Nikishin, Max Schwarzer, Nikishin, Evgenii +9 · 1 voice · 46 citations
Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- Motif: Intrinsic Motivation from Artificial Intelligence Feedback
2023/09/29 by Martin Klissarov, Pierluca D’Oro, Pierluca D'Oro +16 · 1 voice · 30 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling #cs.AI #cs.LG
- When Waiting is not an Option : Learning Options with a Deliberation Cost
2017/09/13 by Jean Harb, Pierre-Luc Bacon, Pierre‐Luc Bacon +6 · 8 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Reinforcement Learning in Robotics #cs.AI
- Block-State Transformers
2023/06/15 by Mahan Fathi, Jonathan Pilault, Fathi, Mahan +11 · 1 voice · 4 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Speech Recognition and Synthesis #Topic Modeling #cs.CL #cs.LG
- Learnings Options End-to-End for Continuous Action Tasks
2017/11/30 by Martin Klissarov, Pierre-Luc Bacon, Pierre‐Luc Bacon +6 · 9 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Reinforcement Learning in Robotics #cs.AI #cs.LG
- Understanding the Curse of Horizon in Off-Policy Evaluation via Conditional Importance Sampling
2019/10/15 by Yao Liu, Liu, Yao, Pierre‐Luc Bacon +4 · 8 citations
Computer Science · Economics, Econometrics and Finance · Mathematics · #Advanced Causal Inference Techniques #Economic Policies and Impacts #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Statistical Methods and Inference #cs.LG #stat.ML
- MaestroMotif: Skill Design from Artificial Intelligence Feedback
2024/12/11 by Martin Klissarov, Mikael Henaff, Klissarov, Martin +21 · 1 voice · 11 citations
Business, Management and Accounting · Computer Science · #AI and HR Technologies #Artificial intelligence #Computer science #cs.AI #cs.CL #cs.LG
- Scaling Trends in Language Model Robustness
2024/07/25 by Nikolaus H. R. Howe, Nikolaus Howe, Ian McKenzie +18 · 1 voice · 13 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Cryptography and Security (cs.CR) #FOS: Computer and information sciences #I.2.7 #Machine Learning (cs.LG) #Natural Language Processing Techniques #Topic Modeling #cs.AI #cs.CL #cs.CR #cs.LG
- Control-Oriented Model-Based Reinforcement Learning with Implicit Differentiation
2021/06/06 by Evgenii Nikishin, Nikishin, Evgenii, Romina Abachi +6 · 5 citations
Computer Science · Decision Sciences · Economics, Econometrics and Finance · Mathematics · #Artificial Intelligence (cs.AI) #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Sports Analytics and Performance #cs.AI #cs.LG #stat.ML
- Options of Interest: Temporal Abstraction with Interest Functions
2020/01/01 by Khimya Khetarpal, Martin Klissarov, Khetarpal, Khimya +8 · 3 citations
Computer Science · Decision Sciences · Engineering · Mathematics · #Advanced Control Systems Optimization #Auction Theory and Applications #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- OptionGAN: Learning Joint Reward-Policy Options using Generative Adversarial Inverse Reinforcement Learning
2017/09/19 by Peter Henderson, Wei-Di Chang, Henderson, Peter +11 · 2 citations
Biochemistry, Genetics and Molecular Biology · Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Receptor Mechanisms and Signaling #Reinforcement Learning in Robotics #cs.LG
- Neural Algorithmic Reasoners are Implicit Planners
2021/10/11 by Andreea Deac, Deac, Andreea, Petar Veličković +10 · 3 citations
Computer Science · Mathematics · #AI-based Problem Solving and Planning #Neural Networks and Applications #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- Graph neural induction of value iteration
2020/09/26 by Andreea Deac, Pierre-Luc Bacon, Deac, Andreea +3 · 2 citations
Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.AI #cs.LG #stat.ML
- XLVIN: eXecuted Latent Value Iteration Nets
2020/10/25 by Andreea Deac, Deac, Andreea, Petar Veličković +10 · 6 citations
Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- Policy Optimization in a Noisy Neighborhood: On Return Landscapes in Continuous Control
2023/09/26 by Nate Rahn, Pierluca D'Oro, Rahn, Nate +9 · 1 voice · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #cs.LG
- Stable Gradients for Stable Learning at Scale in Deep Reinforcement Learning
2025/06/18 by Roger Creus Castanyer, Johan Obando-Ceron, Castanyer, Roger Creus +12 · 1 voice · 7 citations
Computer Science · #Evolutionary Algorithms and Applications #Neural Networks and Applications #Reinforcement Learning in Robotics #cs.LG
- Policy Evaluation Networks
2020/02/26 by Jean Harb, Tom Schaul, Harb, Jean +6 · 1 citation
Computer Science · Engineering · Mathematics · #Infrastructure Resilience and Vulnerability Analysis #Machine Learning and Algorithms #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- An Information-Theoretic Perspective on Credit Assignment in Reinforcement Learning
2021/03/10 by Dilip Arumugam, Peter Henderson, Arumugam, Dilip +4 · 1 citation
Computer Science · Decision Sciences · Engineering · Mathematics · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Information Theory (cs.IT) #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Smart Grid Energy Management #cs.IT #cs.LG #math.IT
- Continuous-Time Meta-Learning with Forward Mode Differentiation
2022/03/02 by Tristan Deleu, David Kanaa, Deleu, Tristan +12 · 1 citation
Computer Science · #Domain Adaptation and Few-Shot Learning #cs.LG