vix.ing · top · new · best · stats · spec

Merlis, Nadav

  1. Ensemble Bootstrapping for Q-Learning
    2021/02/28 by Peer, Oren, Tessler, Chen, Merlis, Nadav +1 · 4 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  2. Reinforcement Learning with History-Dependent Dynamic Contexts
    2023/02/04 by Tennenholtz, Guy, Merlis, Nadav, Shani, Lior +2 · 4 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Systems and Control (eess.SY) #electronic engineering #information engineering
  3. Reinforcement Learning with Trajectory Feedback
    2020/08/13 by Efroni, Yonathan, Merlis, Nadav, Mannor, Shie · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  4. Confidence-Budget Matching for Sequential Budgeted Learning
    2021/02/05 by Efroni, Yonathan, Merlis, Nadav, Saha, Aadirupa +1 · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  5. Tight Regret Bounds for Model-Based Reinforcement Learning with Greedy\n Policies
    2019/05/27 by Yonathan Efroni, Nadav Merlis, Efroni, Yonathan +5 · 2 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
  6. Batch-Size Independent Regret Bounds for the Combinatorial Multi-Armed Bandit Problem
    2019/05/08 by Nadav Merlis, Shie Mannor, Merlis, Nadav +1 · 1 citation
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Optimization and Search Problems
  7. Tight Lower Bounds for Combinatorial Multi-Armed Bandits
    2020/02/13 by Nadav Merlis, Merlis, Nadav, Shie Mannor +1 · 1 citation
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Optimization and Search Problems #Reinforcement Learning in Robotics
  8. Query-Reward Tradeoffs in Multi-Armed Bandits
    2021/10/12 by Nadav Merlis, Merlis, Nadav, Yonathan Efroni +3 · 1 citation
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Search Problems
  9. Improved Algorithms for Contextual Dynamic Pricing
    2024/06/17 by Tullii, Matilde, Gaucher, Solenne, Merlis, Nadav +1 · 2 citations
    #Computer Science and Game Theory (cs.GT) #Data Structures and Algorithms (cs.DS) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  10. Reinforcement Learning with Lookahead Information
    2024/06/04 by Merlis, Nadav · 1 citation
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  11. On Preemption and Learning in Stochastic Scheduling
    2022/05/31 by Merlis, Nadav, Richard, Hugo, Sentenac, Flore +3 · 1 citation
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)