vix.ing · top · new · best · stats · spec

Gergely Neu

  1. A unified view of entropy-regularized Markov decision processes
    2017/05/22 by Gergely Neu, Neu, Gergely, Anders Jönsson +4 · 1 voice · 24 citations
    Computer Science · Mathematics · #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
  2. Boltzmann Exploration Done Right
    2017/05/29 by Nicolò Cesa‐Bianchi, Cesa-Bianchi, Nicolò, Claudio Gentile +5 · 6 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
  3. Information-Theoretic Generalization Bounds for Stochastic Gradient Descent
    2021/02/01 by Gergely Neu, Gintare Karolina Dziugaite, Neu, Gergely +5 · 6 citations
    Computer Science · Engineering · #Stochastic Gradient Optimization Techniques #Sparse and Compressive Sensing Techniques #Privacy-Preserving Technologies in Data
  4. First-order regret bounds for combinatorial semi-bandits
    2015/02/23 by Gergely Neu, Neu, Gergely · 3 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
  5. Logistic Q-Learning
    2020/10/21 by Joan Bas-Serrano, Sebastian Curi, Bas-Serrano, Joan +5 · 5 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adaptive Dynamic Programming Control
  6. Prediction by Random-Walk Perturbation
    2013/02/23 by Luc Devroye, Gábor Lugosi, Devroye, Luc +3 · 5 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Search Problems
  7. Offline Primal-Dual Reinforcement Learning for Linear MDPs
    2023/05/22 by Germano Gabbianelli, Gabbianelli, Germano, Gergely Neu +5 · 3 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Age of Information Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  8. Iterate averaging as regularization for stochastic gradient descent
    2018/02/22 by Gergely Neu, Neu, Gergely, Lorenzo Rosasco +1 · 2 citations
    Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Markov Chains and Monte Carlo Methods #Statistical Methods and Inference #Stochastic Gradient Optimization Techniques
  9. Bisimulation Metrics are Optimal Transport Distances, and Can be Computed Efficiently
    2024/06/06 by Sergio Calo, Calo, Sergio, Anders Jonsson +8 · 2 voices · 1 citation
    Medicine · Neuroscience · #Neurological disorders and treatments #EEG and Brain-Computer Interfaces #Cardiac Arrhythmias and Treatments
  10. Faster saddle-point optimization for solving large-scale Markov decision processes
    2019/09/22 by Joan Bas-Serrano, Bas-Serrano, Joan, Gergely Neu +1 · 1 citation
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Simulation Techniques and Applications
  11. Optimistically Optimistic Exploration for Provably Efficient Infinite-Horizon Reinforcement and Imitation Learning
    2025/02/19 by Antoine Moulin, Moulin, Antoine, Gergely Neu +3 · 1 voice · 3 citations
    Computer Science · Engineering · #AI and Multimedia in Education #Hand Gesture Recognition Systems #Robot Manipulation and Learning #cs.LG
  12. Collaborative Spatial Reuse in Wireless Networks via Selfish Multi-Armed\n Bandits
    2017/10/31 by Francesc Wilhelmi, Cristina Cano, Wilhelmi, Francesc +9 · 1 citation
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Distributed Sensor Networks and Detection Algorithms #Cognitive Radio Networks and Spectrum Sensing
  13. Optimistic Information Directed Sampling
    2024/02/23 by Gergely Neu, Matteo Papini, Neu, Gergely +3 · 2 citations
    Computer Science · #Anomaly Detection Techniques and Applications #FOS: Computer and information sciences #Face and Expression Recognition #Machine Learning (cs.LG) #Machine Learning and Algorithms
  14. First- and Second-Order Bounds for Adversarial Linear Contextual Bandits
    2023/05/01 by Julia Olkhovskaya, Olkhovskaya, Julia, Jack Mayo +7 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
  15. Importance-Weighted Offline Learning Done Right
    2023/09/27 by Germano Gabbianelli, Gabbianelli, Germano, Gergely Neu +3 · 1 citation
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Smart Grid Energy Management
  16. Offline RL via Feature-Occupancy Gradient Ascent
    2024/05/22 by Gergely Neu, Nneka Okolo, Neu, Gergely +1 · 1 voice · 1 citation
    #cs.LG
  17. Inverse Q-Learning Done Right: Offline Imitation Learning in Qπ-Realizable MDPs
    2025/05/26 by Antoine Moulin, Moulin, Antoine, Gergely Neu +3 · 1 voice · 2 citations
    Computer Science · #Algorithms and Data Compression #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Neural Networks and Applications #cs.LG
  18. Confidence Sequences for Generalized Linear Models via Regret Analysis
    2025/04/23 by Eugenio Clerico, Hamish Flynn, Clerico, Eugenio +5 · 2 citations
    Mathematics · #Statistical Methods and Inference