Asaf Cassel
- Multi-turn Reinforcement Learning from Preference Human Feedback
2024/05/23 by Lior Shani, Shani, Lior, Aviv Rosenberg +23 · 1 voice · 25 citations
Computer Science · #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #cs.LG
- Efficient Rate Optimal Regret for Adversarial Contextual MDPs Using Online Function Approximation
2023/03/02 by Orin Levy, Levy, Orin, Alon Cohen +5 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Anomaly Detection Techniques and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Eluder-based Regret for Stochastic Contextual MDPs
2022/11/27 by Orin Levy, Asaf Cassel, Levy, Orin +5 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Bayesian Modeling and Causal Inference #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Near-Optimal Regret in Linear MDPs with Aggregate Bandit Feedback
2024/05/13 by Asaf Cassel, Cassel, Asaf, Haipeng Luo +5 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Distributed Sensor Networks and Detection Algorithms #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and ELM
- Warm-up Free Policy Optimization: Improved Regret in Linear Markov Decision Processes
2024/07/03 by Asaf Cassel, Cassel, Asaf, Aviv Rosenberg +1 · 1 citation
Economics, Econometrics and Finance · Energy · #Economic Policies and Impacts #Energy, Environment, and Transportation Policies