vix.ing · top · new · best · stats · spec

Efroni, Yonathan

  1. Action Robust Reinforcement Learning and Applications in Continuous Control
    2019/01/26 by Chen Tessler, Yonathan Efroni, Tessler, Chen +3 · 14 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics
  2. Exploration-Exploitation in Constrained MDPs
    2020/03/04 by Yonathan Efroni, Efroni, Yonathan, Shie Mannor +3 · 12 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
  3. Adaptive Trust Region Policy Optimization: Global Convergence and Faster\n Rates for Regularized MDPs
    2019/09/06 by Lior Shani, Yonathan Efroni, Shani, Lior +3 · 7 citations
    Computer Science · #Reinforcement Learning in Robotics #Distributed Control Multi-Agent Systems
  4. Mirror Descent Policy Optimization
    2020/05/20 by Tomar, Manan, Shani, Lior, Efroni, Yonathan +1 · 5 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  5. RL for Latent MDPs: Regret Guarantees and a Lower Bound
    2021/02/09 by Jeongyeol Kwon, Yonathan Efroni, Kwon, Jeongyeol +5 · 5 citations
    Computer Science · Decision Sciences · Mathematics · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Markov Chains and Monte Carlo Methods
  6. Guaranteed Discovery of Control-Endogenous Latent States with Multi-Step Inverse Models
    2022/07/17 by Alex Lamb, Lamb, Alex, Riashat Islam +17 · 5 citations
    Computer Science · #Time Series Analysis and Forecasting #Reinforcement Learning in Robotics #AI-based Problem Solving and Planning
  7. Provable Reinforcement Learning with a Short-Term Memory
    2022/02/08 by Efroni, Yonathan, Jin, Chi, Krishnamurthy, Akshay +1 · 4 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  8. Optimistic Policy Optimization with Bandit Feedback
    2020/02/19 by Efroni, Yonathan, Shani, Lior, Rosenberg, Aviv +1 · 3 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  9. Agent-Controller Representations: Principled Offline RL with Rich Exogenous Information
    2022/10/31 by Islam, Riashat, Tomar, Manan, Lamb, Alex +8 · 3 citations
    #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  10. Reinforcement Learning with Trajectory Feedback
    2020/08/13 by Efroni, Yonathan, Merlis, Nadav, Mannor, Shie · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  11. Confidence-Budget Matching for Sequential Budgeted Learning
    2021/02/05 by Efroni, Yonathan, Merlis, Nadav, Saha, Aadirupa +1 · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  12. Minimax Regret for Stochastic Shortest Path
    2021/03/24 by Cohen, Alon, Efroni, Yonathan, Mansour, Yishay +1 · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  13. The Bias of Harmful Label Associations in Vision-Language Models
    2024/02/11 by Caner Hazırbaş, Hazirbas, Caner, Alicia Sun +5 · 3 citations
    Social Sciences · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Religion and Sociopolitical Dynamics in Nigeria
  14. Tight Regret Bounds for Model-Based Reinforcement Learning with Greedy\n Policies
    2019/05/27 by Yonathan Efroni, Efroni, Yonathan, Nadav Merlis +5 · 2 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
  15. Reinforcement Learning in Reward-Mixing MDPs
    2021/10/07 by Kwon, Jeongyeol, Efroni, Yonathan, Caramanis, Constantine +1 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Information Theory (cs.IT) #Machine Learning (cs.LG)
  16. Provable RL with Exogenous Distractors via Multistep Inverse Dynamics
    2021/10/17 by Yonathan Efroni, Efroni, Yonathan, Dipendra Misra +7 · 1 citation
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  17. Query-Reward Tradeoffs in Multi-Armed Bandits
    2021/10/12 by Nadav Merlis, Yonathan Efroni, Merlis, Nadav +3 · 1 citation
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Search Problems
  18. Reward-Mixing MDPs with a Few Latent Contexts are Learnable
    2022/10/05 by Jeongyeol Kwon, Yonathan Efroni, Kwon, Jeongyeol +5 · 1 citation
    Computer Science · #FOS: Computer and information sciences #Information Theory (cs.IT) #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  19. PcLast: Discovering Plannable Continuous Latent States
    2023/11/06 by Koul, Anurag, Sujit, Shivakanth, Chen, Shaoru +11 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  20. RL in Latent MDPs is Tractable: Online Guarantees via Off-Policy Evaluation
    2024/06/03 by Kwon, Jeongyeol, Mannor, Shie, Caramanis, Constantine +1 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Systems and Control (eess.SY) #electronic engineering #information engineering
  21. Imbalanced Gradients in RL Post-Training of Multi-Task LLMs
    2025/10/22 by R Wu, Wu, Runzhe, Samanta, Ankur +16 · 2 citations
    Computer Science · Medicine · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Healthcare and Education #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Topic Modeling
  22. Exploiting Structure in Offline Multi-Agent RL: The Benefits of Low Interaction Rank
    2024/10/01 by Zhan, Wenhao, Fujimoto, Scott, Zhu, Zheqing +3 · 1 citation
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  23. Aligned Multi Objective Optimization
    2025/02/19 by Yonathan Efroni, Efroni, Yonathan, Ben Kertzu +10 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Advanced Multi-Objective Optimization Algorithms #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics