vix.ing · top · new · best · stats · spec

Asaf Cassel

  1. Multi-turn Reinforcement Learning from Preference Human Feedback
    2024/05/23 by Lior Shani, Shani, Lior, Aviv Rosenberg +23 · 1 voice · 25 citations
    Computer Science · #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #cs.LG
  2. Efficient Rate Optimal Regret for Adversarial Contextual MDPs Using Online Function Approximation
    2023/03/02 by Orin Levy, Levy, Orin, Alon Cohen +5 · 3 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Anomaly Detection Techniques and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG)
  3. Eluder-based Regret for Stochastic Contextual MDPs
    2022/11/27 by Orin Levy, Asaf Cassel, Levy, Orin +5 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Bayesian Modeling and Causal Inference #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  4. Near-Optimal Regret in Linear MDPs with Aggregate Bandit Feedback
    2024/05/13 by Asaf Cassel, Cassel, Asaf, Haipeng Luo +5 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Distributed Sensor Networks and Detection Algorithms #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and ELM
  5. Warm-up Free Policy Optimization: Improved Regret in Linear Markov Decision Processes
    2024/07/03 by Asaf Cassel, Cassel, Asaf, Aviv Rosenberg +1 · 1 citation
    Economics, Econometrics and Finance · Energy · #Economic Policies and Impacts #Energy, Environment, and Transportation Policies