Daniil Tiapkin
- Generative Flow Networks as Entropy-Regularized RL
2023/10/19 by Daniil Tiapkin, Tiapkin, Daniil, Н. Ф. Морозов +5 · 11 citations
Computer Science · #Reinforcement Learning in Robotics #Explainable Artificial Intelligence (XAI)
- Incentivized Learning in Principal-Agent Bandit Games
2024/03/06 by Antoine Scheid, Scheid, Antoine, Daniil Tiapkin +12 · 3 citations
Decision Sciences · Social Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Experimental Behavioral Economics Studies
- Primal-Dual Stochastic Mirror Descent for MDPs
2021/02/27 by Daniil Tiapkin, Tiapkin, Daniil, Alexander Gasnikov +1 · 1 citation
Computer Science · #Reinforcement Learning in Robotics #Age of Information Optimization #Bayesian Modeling and Causal Inference
- From Dirichlet to Rubin: Optimistic Exploration in RL without Bonuses
2022/05/16 by Daniil Tiapkin, Denis Belomestny, Tiapkin, Daniil +13 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
- On Teacher Hacking in Language Model Distillation
2025/02/04 by Daniil Tiapkin, Tiapkin, Daniil, Daniele Calandriello +11 · 2 voices · 1 citation
#cs.LG #cs.AI #cs.CL #stat.ML
- Improving GFlowNets with Monte Carlo Tree Search
2024/06/19 by Н. Ф. Морозов, Daniil Tiapkin, Morozov, Nikita +7 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural Networks and Applications