vix.ing · top · new · best · stats · spec

Aldo Pacchiano

  1. Supervised Pretraining Can Learn In-Context Reinforcement Learning
    2023/06/26 by Jonathan Lee, Lee, Jonathan N., Annie Xie +11 · 15 citations
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #Machine Learning and Data Classification
  2. Unpacking Reward Shaping: Understanding the Benefits of Reward Engineering on Sample Complexity
    2022/10/18 by Abhishek Gupta, Aldo Pacchiano, Gupta, Abhishek +7 · 10 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Software Engineering Research
  3. Effective Diversity in Population Based Reinforcement Learning
    2020/02/03 by Jack Parker-Holder, Aldo Pacchiano, Parker-Holder, Jack +5 · 7 citations
    Computer Science · Business, Management and Accounting · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Supply Chain and Inventory Management
  4. Active Preference Optimization for Sample Efficient RLHF
    2024/02/16 by Nirjhar Das, Das, Nirjhar, Souradip Chakraborty +5 · 11 citations
    Computer Science · #Advanced Data Compression Techniques #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  5. Stochastic Bandits with Linear Constraints
    2020/06/17 by Aldo Pacchiano, Mohammad Ghavamzadeh, Pacchiano, Aldo +5 · 5 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Search Problems #Smart Grid Energy Management
  6. Model Selection in Contextual Stochastic Bandit Problems
    2020/03/03 by Aldo Pacchiano, Pacchiano, Aldo, My V. T. Phan +11 · 5 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
  7. Reinforcement Learning in Linear MDPs: Constant Regret and\n Representation Selection
    2021/10/27 by Matteo Papini, Andrea Tirinzoni, Papini, Matteo +9 · 2 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Age of Information Optimization #Advanced Bandit Algorithms Research
  8. Leveraging Offline Data in Online Reinforcement Learning
    2022/11/09 by Andrew Wagenmaker, Aldo Pacchiano, Wagenmaker, Andrew +1 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  9. Second Order Bounds for Contextual Bandits with Function Approximation
    2024/09/24 by Aldo Pacchiano, Pacchiano, Aldo · 3 citations
    Decision Sciences · #Advanced Bandit Algorithms Research
  10. Online learning with kernel losses
    2018/02/27 by Aldo Pacchiano, Niladri S. Chatterji, Pacchiano, Aldo +3 · 1 citation
    Decision Sciences · Computer Science · Engineering · #Advanced Bandit Algorithms Research #Machine Learning and Algorithms #Sparse and Compressive Sensing Techniques
  11. Regret Bound Balancing and Elimination for Model Selection in Bandits\n and RL
    2020/12/23 by Aldo Pacchiano, Christoph Dann, Pacchiano, Aldo +5 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Other Statistics (stat.OT) #Reinforcement Learning in Robotics
  12. Online Nonsubmodular Minimization with Delayed Costs: From Full Information to Bandit Feedback
    2022/05/15 by Tianyi Lin, Lin, Tianyi, Aldo Pacchiano +5 · 1 citation
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques
  13. Non-Asymptotic Best Policy Identification Guarantees in Online Reinforcement Learning
    2026/07/19 by Joseph Lazzaro, Alessio Russo, Aldo Pacchiano
    #stat.ML #cs.LG