Aldo Pacchiano
- Supervised Pretraining Can Learn In-Context Reinforcement Learning
2023/06/26 by Jonathan Lee, Lee, Jonathan N., Annie Xie +11 · 15 citations
Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #Machine Learning and Data Classification
- Unpacking Reward Shaping: Understanding the Benefits of Reward Engineering on Sample Complexity
2022/10/18 by Abhishek Gupta, Aldo Pacchiano, Gupta, Abhishek +7 · 10 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Software Engineering Research
- Effective Diversity in Population Based Reinforcement Learning
2020/02/03 by Jack Parker-Holder, Aldo Pacchiano, Parker-Holder, Jack +5 · 7 citations
Computer Science · Business, Management and Accounting · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Supply Chain and Inventory Management
- Active Preference Optimization for Sample Efficient RLHF
2024/02/16 by Nirjhar Das, Das, Nirjhar, Souradip Chakraborty +5 · 11 citations
Computer Science · #Advanced Data Compression Techniques #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Stochastic Bandits with Linear Constraints
2020/06/17 by Aldo Pacchiano, Mohammad Ghavamzadeh, Pacchiano, Aldo +5 · 5 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Search Problems #Smart Grid Energy Management
- Model Selection in Contextual Stochastic Bandit Problems
2020/03/03 by Aldo Pacchiano, Pacchiano, Aldo, My V. T. Phan +11 · 5 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
- Reinforcement Learning in Linear MDPs: Constant Regret and\n Representation Selection
2021/10/27 by Matteo Papini, Andrea Tirinzoni, Papini, Matteo +9 · 2 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Age of Information Optimization #Advanced Bandit Algorithms Research
- Leveraging Offline Data in Online Reinforcement Learning
2022/11/09 by Andrew Wagenmaker, Aldo Pacchiano, Wagenmaker, Andrew +1 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- Second Order Bounds for Contextual Bandits with Function Approximation
2024/09/24 by Aldo Pacchiano, Pacchiano, Aldo · 3 citations
Decision Sciences · #Advanced Bandit Algorithms Research
- Online learning with kernel losses
2018/02/27 by Aldo Pacchiano, Niladri S. Chatterji, Pacchiano, Aldo +3 · 1 citation
Decision Sciences · Computer Science · Engineering · #Advanced Bandit Algorithms Research #Machine Learning and Algorithms #Sparse and Compressive Sensing Techniques
- Regret Bound Balancing and Elimination for Model Selection in Bandits\n and RL
2020/12/23 by Aldo Pacchiano, Christoph Dann, Pacchiano, Aldo +5 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Other Statistics (stat.OT) #Reinforcement Learning in Robotics
- Online Nonsubmodular Minimization with Delayed Costs: From Full Information to Bandit Feedback
2022/05/15 by Tianyi Lin, Lin, Tianyi, Aldo Pacchiano +5 · 1 citation
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques
- Non-Asymptotic Best Policy Identification Guarantees in Online Reinforcement Learning
2026/07/19 by Joseph Lazzaro, Alessio Russo, Aldo Pacchiano
#stat.ML #cs.LG