Merlis, Nadav
- Ensemble Bootstrapping for Q-Learning
2021/02/28 by Peer, Oren, Tessler, Chen, Merlis, Nadav +1 · 4 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Reinforcement Learning with History-Dependent Dynamic Contexts
2023/02/04 by Tennenholtz, Guy, Merlis, Nadav, Shani, Lior +2 · 4 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Systems and Control (eess.SY) #electronic engineering #information engineering
- Reinforcement Learning with Trajectory Feedback
2020/08/13 by Efroni, Yonathan, Merlis, Nadav, Mannor, Shie · 2 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Confidence-Budget Matching for Sequential Budgeted Learning
2021/02/05 by Efroni, Yonathan, Merlis, Nadav, Saha, Aadirupa +1 · 2 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Tight Regret Bounds for Model-Based Reinforcement Learning with Greedy\n Policies
2019/05/27 by Yonathan Efroni, Nadav Merlis, Efroni, Yonathan +5 · 2 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
- Batch-Size Independent Regret Bounds for the Combinatorial Multi-Armed Bandit Problem
2019/05/08 by Nadav Merlis, Shie Mannor, Merlis, Nadav +1 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Optimization and Search Problems
- Tight Lower Bounds for Combinatorial Multi-Armed Bandits
2020/02/13 by Nadav Merlis, Merlis, Nadav, Shie Mannor +1 · 1 citation
Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Optimization and Search Problems #Reinforcement Learning in Robotics
- Query-Reward Tradeoffs in Multi-Armed Bandits
2021/10/12 by Nadav Merlis, Merlis, Nadav, Yonathan Efroni +3 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Search Problems
- Improved Algorithms for Contextual Dynamic Pricing
2024/06/17 by Tullii, Matilde, Gaucher, Solenne, Merlis, Nadav +1 · 2 citations
#Computer Science and Game Theory (cs.GT) #Data Structures and Algorithms (cs.DS) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Reinforcement Learning with Lookahead Information
2024/06/04 by Merlis, Nadav · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- On Preemption and Learning in Stochastic Scheduling
2022/05/31 by Merlis, Nadav, Richard, Hugo, Sentenac, Flore +3 · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)