vix.ing · top · new · best · stats · spec

Neu, Gergely

  1. A unified view of entropy-regularized Markov decision processes
    2017/05/22 by Gergely Neu, Anders Jönsson, Neu, Gergely +4 · 1 voice · 25 citations
    Computer Science · Mathematics · #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
  2. Boltzmann Exploration Done Right
    2017/05/29 by Nicolò Cesa‐Bianchi, Cesa-Bianchi, Nicolò, Claudio Gentile +5 · 9 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
  3. Explore no more: Improved high-probability regret bounds for non-stochastic bandits
    2015/06/10 by Neu, Gergely · 7 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  4. Information-Theoretic Generalization Bounds for Stochastic Gradient Descent
    2021/02/01 by Gergely Neu, Gintare Karolina Dziugaite, Neu, Gergely +5 · 6 citations
    Computer Science · Engineering · #Stochastic Gradient Optimization Techniques #Sparse and Compressive Sensing Techniques #Privacy-Preserving Technologies in Data
  5. Importance weighting without importance weights: An efficient algorithm for combinatorial semi-bandits
    2015/03/17 by Neu, Gergely, Bartók, Gábor · 4 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  6. First-order regret bounds for combinatorial semi-bandits
    2015/02/23 by Gergely Neu, Neu, Gergely · 3 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
  7. Logistic Q-Learning
    2020/10/21 by Joan Bas-Serrano, Bas-Serrano, Joan, Sebastian Curi +5 · 5 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adaptive Dynamic Programming Control
  8. Prediction by Random-Walk Perturbation
    2013/02/23 by Luc Devroye, Devroye, Luc, Gábor Lugosi +3 · 5 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Search Problems
  9. Efficient and Robust Algorithms for Adversarial Linear Contextual Bandits
    2020/02/01 by Neu, Gergely, Olkhovskaya, Julia · 4 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  10. Fast Rates for Online Prediction with Abstention
    2020/01/28 by Neu, Gergely, Zhivotovskiy, Nikita · 3 citations
    #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Statistics Theory (math.ST)
  11. An efficient algorithm for learning with semi-bandit feedback
    2013/05/13 by Neu, Gergely, Bartók, Gábor · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  12. A Unifying View of Optimism in Episodic Reinforcement Learning
    2020/07/03 by Neu, Gergely, Pike-Burke, Ciara · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  13. Offline Primal-Dual Reinforcement Learning for Linear MDPs
    2023/05/22 by Germano Gabbianelli, Gabbianelli, Germano, Gergely Neu +5 · 3 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Age of Information Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  14. Lifting the Information Ratio: An Information-Theoretic Analysis of Thompson Sampling for Contextual Bandits
    2022/05/27 by Neu, Gergely, Olkhovskaya, Julia, Papini, Matteo +1 · 3 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  15. Collaborative Spatial Reuse in Wireless Networks via Selfish Multi-Armed\n Bandits
    2017/10/31 by Francesc Wilhelmi, Wilhelmi, Francesc, Cristina Cano +9 · 2 citations
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Distributed Sensor Networks and Detection Algorithms #Cognitive Radio Networks and Spectrum Sensing
  16. Efficient Global Planning in Large MDPs via Stochastic Primal-Dual Optimization
    2022/10/21 by Neu, Gergely, Okolo, Nneka · 2 citations
    #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC)
  17. Proximal Point Imitation Learning
    2022/09/22 by Viano, Luca, Kamoutsi, Angeliki, Neu, Gergely +2 · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  18. Apprenticeship Learning using Inverse Reinforcement Learning and Gradient Methods
    2012/06/20 by Neu, Gergely, Szepesvari, Csaba · 1 citation
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  19. Optimistic Planning by Regularized Dynamic Programming
    2023/02/27 by Moulin, Antoine, Neu, Gergely · 2 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  20. Iterate averaging as regularization for stochastic gradient descent
    2018/02/22 by Gergely Neu, Lorenzo Rosasco, Neu, Gergely +1 · 2 citations
    Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Markov Chains and Monte Carlo Methods #Statistical Methods and Inference #Stochastic Gradient Optimization Techniques
  21. Generalization bounds for mixing processes via delayed online-to-PAC conversions
    2024/06/18 by Abeles, Baptiste, Clerico, Eugenio, Neu, Gergely · 3 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  22. Bisimulation Metrics are Optimal Transport Distances, and Can be Computed Efficiently
    2024/06/06 by Sergio Calo, Calo, Sergio, Anders Jonsson +8 · 2 voices · 1 citation
    Medicine · Neuroscience · #Neurological disorders and treatments #EEG and Brain-Computer Interfaces #Cardiac Arrhythmias and Treatments
  23. Bandit Principal Component Analysis
    2019/02/08 by Kotłowski, Wojciech, Neu, Gergely · 1 citation
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  24. Faster saddle-point optimization for solving large-scale Markov decision processes
    2019/09/22 by Joan Bas-Serrano, Gergely Neu, Bas-Serrano, Joan +1 · 1 citation
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Simulation Techniques and Applications
  25. Optimistically Optimistic Exploration for Provably Efficient Infinite-Horizon Reinforcement and Imitation Learning
    2025/02/19 by Antoine Moulin, Gergely Neu, Moulin, Antoine +3 · 1 voice · 3 citations
    Computer Science · Engineering · #AI and Multimedia in Education #Hand Gesture Recognition Systems #Robot Manipulation and Learning #cs.LG
  26. Optimistic Information Directed Sampling
    2024/02/23 by Gergely Neu, Matteo Papini, Neu, Gergely +3 · 2 citations
    Computer Science · #Anomaly Detection Techniques and Applications #FOS: Computer and information sciences #Face and Expression Recognition #Machine Learning (cs.LG) #Machine Learning and Algorithms
  27. First- and Second-Order Bounds for Adversarial Linear Contextual Bandits
    2023/05/01 by Julia Olkhovskaya, Jack Mayo, Olkhovskaya, Julia +7 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
  28. Importance-Weighted Offline Learning Done Right
    2023/09/27 by Germano Gabbianelli, Gabbianelli, Germano, Gergely Neu +3 · 1 citation
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Smart Grid Energy Management
  29. Offline RL via Feature-Occupancy Gradient Ascent
    2024/05/22 by Gergely Neu, Neu, Gergely, Nneka Okolo +1 · 1 voice · 1 citation
    #cs.LG
  30. Inverse Q-Learning Done Right: Offline Imitation Learning in Qπ-Realizable MDPs
    2025/05/26 by Antoine Moulin, Moulin, Antoine, Gergely Neu +3 · 1 voice · 2 citations
    Computer Science · #Algorithms and Data Compression #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Neural Networks and Applications #cs.LG
  31. Confidence Sequences for Generalized Linear Models via Regret Analysis
    2025/04/23 by Eugenio Clerico, Hamish Flynn, Clerico, Eugenio +5 · 2 citations
    Mathematics · #Statistical Methods and Inference