Gergely Neu
- A unified view of entropy-regularized Markov decision processes
2017/05/22 by Gergely Neu, Neu, Gergely, Anders Jönsson +4 · 1 voice · 24 citations
Computer Science · Mathematics · #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- Boltzmann Exploration Done Right
2017/05/29 by Nicolò Cesa‐Bianchi, Cesa-Bianchi, Nicolò, Claudio Gentile +5 · 6 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
- Information-Theoretic Generalization Bounds for Stochastic Gradient Descent
2021/02/01 by Gergely Neu, Gintare Karolina Dziugaite, Neu, Gergely +5 · 6 citations
Computer Science · Engineering · #Stochastic Gradient Optimization Techniques #Sparse and Compressive Sensing Techniques #Privacy-Preserving Technologies in Data
- First-order regret bounds for combinatorial semi-bandits
2015/02/23 by Gergely Neu, Neu, Gergely · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
- Logistic Q-Learning
2020/10/21 by Joan Bas-Serrano, Sebastian Curi, Bas-Serrano, Joan +5 · 5 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adaptive Dynamic Programming Control
- Prediction by Random-Walk Perturbation
2013/02/23 by Luc Devroye, Gábor Lugosi, Devroye, Luc +3 · 5 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Search Problems
- Offline Primal-Dual Reinforcement Learning for Linear MDPs
2023/05/22 by Germano Gabbianelli, Gabbianelli, Germano, Gergely Neu +5 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Age of Information Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Iterate averaging as regularization for stochastic gradient descent
2018/02/22 by Gergely Neu, Neu, Gergely, Lorenzo Rosasco +1 · 2 citations
Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Markov Chains and Monte Carlo Methods #Statistical Methods and Inference #Stochastic Gradient Optimization Techniques
- Bisimulation Metrics are Optimal Transport Distances, and Can be Computed Efficiently
2024/06/06 by Sergio Calo, Calo, Sergio, Anders Jonsson +8 · 2 voices · 1 citation
Medicine · Neuroscience · #Neurological disorders and treatments #EEG and Brain-Computer Interfaces #Cardiac Arrhythmias and Treatments
- Faster saddle-point optimization for solving large-scale Markov decision processes
2019/09/22 by Joan Bas-Serrano, Bas-Serrano, Joan, Gergely Neu +1 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Simulation Techniques and Applications
- Optimistically Optimistic Exploration for Provably Efficient Infinite-Horizon Reinforcement and Imitation Learning
2025/02/19 by Antoine Moulin, Moulin, Antoine, Gergely Neu +3 · 1 voice · 3 citations
Computer Science · Engineering · #AI and Multimedia in Education #Hand Gesture Recognition Systems #Robot Manipulation and Learning #cs.LG
- Collaborative Spatial Reuse in Wireless Networks via Selfish Multi-Armed\n Bandits
2017/10/31 by Francesc Wilhelmi, Cristina Cano, Wilhelmi, Francesc +9 · 1 citation
Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Distributed Sensor Networks and Detection Algorithms #Cognitive Radio Networks and Spectrum Sensing
- Optimistic Information Directed Sampling
2024/02/23 by Gergely Neu, Matteo Papini, Neu, Gergely +3 · 2 citations
Computer Science · #Anomaly Detection Techniques and Applications #FOS: Computer and information sciences #Face and Expression Recognition #Machine Learning (cs.LG) #Machine Learning and Algorithms
- First- and Second-Order Bounds for Adversarial Linear Contextual Bandits
2023/05/01 by Julia Olkhovskaya, Olkhovskaya, Julia, Jack Mayo +7 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
- Importance-Weighted Offline Learning Done Right
2023/09/27 by Germano Gabbianelli, Gabbianelli, Germano, Gergely Neu +3 · 1 citation
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Smart Grid Energy Management
- Offline RL via Feature-Occupancy Gradient Ascent
2024/05/22 by Gergely Neu, Nneka Okolo, Neu, Gergely +1 · 1 voice · 1 citation
#cs.LG
- Inverse Q-Learning Done Right: Offline Imitation Learning in Qπ-Realizable MDPs
2025/05/26 by Antoine Moulin, Moulin, Antoine, Gergely Neu +3 · 1 voice · 2 citations
Computer Science · #Algorithms and Data Compression #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Neural Networks and Applications #cs.LG
- Confidence Sequences for Generalized Linear Models via Regret Analysis
2025/04/23 by Eugenio Clerico, Hamish Flynn, Clerico, Eugenio +5 · 2 citations
Mathematics · #Statistical Methods and Inference