Neu, Gergely
- A unified view of entropy-regularized Markov decision processes
2017/05/22 by Gergely Neu, Anders Jönsson, Neu, Gergely +4 · 1 voice · 25 citations
Computer Science · Mathematics · #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- Boltzmann Exploration Done Right
2017/05/29 by Nicolò Cesa‐Bianchi, Cesa-Bianchi, Nicolò, Claudio Gentile +5 · 9 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
- Explore no more: Improved high-probability regret bounds for non-stochastic bandits
2015/06/10 by Neu, Gergely · 7 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Information-Theoretic Generalization Bounds for Stochastic Gradient Descent
2021/02/01 by Gergely Neu, Gintare Karolina Dziugaite, Neu, Gergely +5 · 6 citations
Computer Science · Engineering · #Stochastic Gradient Optimization Techniques #Sparse and Compressive Sensing Techniques #Privacy-Preserving Technologies in Data
- Importance weighting without importance weights: An efficient algorithm for combinatorial semi-bandits
2015/03/17 by Neu, Gergely, Bartók, Gábor · 4 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- First-order regret bounds for combinatorial semi-bandits
2015/02/23 by Gergely Neu, Neu, Gergely · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
- Logistic Q-Learning
2020/10/21 by Joan Bas-Serrano, Bas-Serrano, Joan, Sebastian Curi +5 · 5 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adaptive Dynamic Programming Control
- Prediction by Random-Walk Perturbation
2013/02/23 by Luc Devroye, Devroye, Luc, Gábor Lugosi +3 · 5 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Search Problems
- Efficient and Robust Algorithms for Adversarial Linear Contextual Bandits
2020/02/01 by Neu, Gergely, Olkhovskaya, Julia · 4 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Fast Rates for Online Prediction with Abstention
2020/01/28 by Neu, Gergely, Zhivotovskiy, Nikita · 3 citations
#FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Statistics Theory (math.ST)
- An efficient algorithm for learning with semi-bandit feedback
2013/05/13 by Neu, Gergely, Bartók, Gábor · 2 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- A Unifying View of Optimism in Episodic Reinforcement Learning
2020/07/03 by Neu, Gergely, Pike-Burke, Ciara · 2 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Offline Primal-Dual Reinforcement Learning for Linear MDPs
2023/05/22 by Germano Gabbianelli, Gabbianelli, Germano, Gergely Neu +5 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Age of Information Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Lifting the Information Ratio: An Information-Theoretic Analysis of Thompson Sampling for Contextual Bandits
2022/05/27 by Neu, Gergely, Olkhovskaya, Julia, Papini, Matteo +1 · 3 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- Collaborative Spatial Reuse in Wireless Networks via Selfish Multi-Armed\n Bandits
2017/10/31 by Francesc Wilhelmi, Wilhelmi, Francesc, Cristina Cano +9 · 2 citations
Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Distributed Sensor Networks and Detection Algorithms #Cognitive Radio Networks and Spectrum Sensing
- Efficient Global Planning in Large MDPs via Stochastic Primal-Dual Optimization
2022/10/21 by Neu, Gergely, Okolo, Nneka · 2 citations
#FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC)
- Proximal Point Imitation Learning
2022/09/22 by Viano, Luca, Kamoutsi, Angeliki, Neu, Gergely +2 · 2 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- Apprenticeship Learning using Inverse Reinforcement Learning and Gradient Methods
2012/06/20 by Neu, Gergely, Szepesvari, Csaba · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Optimistic Planning by Regularized Dynamic Programming
2023/02/27 by Moulin, Antoine, Neu, Gergely · 2 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Iterate averaging as regularization for stochastic gradient descent
2018/02/22 by Gergely Neu, Lorenzo Rosasco, Neu, Gergely +1 · 2 citations
Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Markov Chains and Monte Carlo Methods #Statistical Methods and Inference #Stochastic Gradient Optimization Techniques
- Generalization bounds for mixing processes via delayed online-to-PAC conversions
2024/06/18 by Abeles, Baptiste, Clerico, Eugenio, Neu, Gergely · 3 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- Bisimulation Metrics are Optimal Transport Distances, and Can be Computed Efficiently
2024/06/06 by Sergio Calo, Calo, Sergio, Anders Jonsson +8 · 2 voices · 1 citation
Medicine · Neuroscience · #Neurological disorders and treatments #EEG and Brain-Computer Interfaces #Cardiac Arrhythmias and Treatments
- Bandit Principal Component Analysis
2019/02/08 by Kotłowski, Wojciech, Neu, Gergely · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Faster saddle-point optimization for solving large-scale Markov decision processes
2019/09/22 by Joan Bas-Serrano, Gergely Neu, Bas-Serrano, Joan +1 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Simulation Techniques and Applications
- Optimistically Optimistic Exploration for Provably Efficient Infinite-Horizon Reinforcement and Imitation Learning
2025/02/19 by Antoine Moulin, Gergely Neu, Moulin, Antoine +3 · 1 voice · 3 citations
Computer Science · Engineering · #AI and Multimedia in Education #Hand Gesture Recognition Systems #Robot Manipulation and Learning #cs.LG
- Optimistic Information Directed Sampling
2024/02/23 by Gergely Neu, Matteo Papini, Neu, Gergely +3 · 2 citations
Computer Science · #Anomaly Detection Techniques and Applications #FOS: Computer and information sciences #Face and Expression Recognition #Machine Learning (cs.LG) #Machine Learning and Algorithms
- First- and Second-Order Bounds for Adversarial Linear Contextual Bandits
2023/05/01 by Julia Olkhovskaya, Jack Mayo, Olkhovskaya, Julia +7 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
- Importance-Weighted Offline Learning Done Right
2023/09/27 by Germano Gabbianelli, Gabbianelli, Germano, Gergely Neu +3 · 1 citation
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Smart Grid Energy Management
- Offline RL via Feature-Occupancy Gradient Ascent
2024/05/22 by Gergely Neu, Neu, Gergely, Nneka Okolo +1 · 1 voice · 1 citation
#cs.LG
- Inverse Q-Learning Done Right: Offline Imitation Learning in Qπ-Realizable MDPs
2025/05/26 by Antoine Moulin, Moulin, Antoine, Gergely Neu +3 · 1 voice · 2 citations
Computer Science · #Algorithms and Data Compression #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Neural Networks and Applications #cs.LG
- Confidence Sequences for Generalized Linear Models via Regret Analysis
2025/04/23 by Eugenio Clerico, Hamish Flynn, Clerico, Eugenio +5 · 2 citations
Mathematics · #Statistical Methods and Inference