vix.ing · top · new · best · stats · spec

Kumar, Aviral

  1. Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
    2025/07/07 by Gheorghe Comanici, Eric Bieber, Comanici, Gheorghe +6844 · 8 voices · 1390 citations
    #cs.CL #cs.AI
  2. Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context
    2024/03/08 by Gemini Robotics Team, Petko Georgiev, Gemini Team +2277 · 4 voices · 597 citations
    Computer Science · #Semantic Web and Ontologies
  3. Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters
    2024/08/06 by Charlie Snell, Snell, Charlie, Jaehoon Lee +5 · 9 voices · 414 citations
    #cs.LG #cs.CL
  4. Training Language Models to Self-Correct via Reinforcement Learning
    2024/09/19 by Aviral Kumar, Kumar, Aviral, Vincent Zhuang +36 · 2 voices · 77 citations
    Computer Science · #Speech and dialogue systems #Topic Modeling #Natural Language Processing Techniques
  5. Inference-Aware Fine-Tuning for Best-of-N Sampling in Large Language Models
    2024/12/18 by Yinlam Chow, Guy Tennenholtz, Chow, Yinlam +18 · 7 voices · 26 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques
  6. Conservative Q-Learning for Offline Reinforcement Learning
    2020/06/08 by Aviral Kumar, Kumar, Aviral, Aurick Zhou +5 · 183 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  7. Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems
    2020/05/04 by Sergey Levine, Aviral Kumar, Levine, Sergey +5 · 225 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Scheduling and Optimization Algorithms
  8. D4RL: Datasets for Deep Data-Driven Reinforcement Learning
    2020/04/15 by Justin Fu, Aviral Kumar, Fu, Justin +7 · 165 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Data Stream Mining Techniques #Autonomous Vehicle Technology and Safety
  9. Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning
    2019/10/01 by Xue Bin Peng, Aviral Kumar, Peng, Xue Bin +5 · 81 citations
    Computer Science · Engineering · #Adaptive Dynamic Programming Control #Advanced Control Systems Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  10. Stabilizing Off-Policy Q-Learning via Bootstrapping Error Reduction
    2019/06/03 by Aviral Kumar, Justin Fu, Kumar, Aviral +5 · 64 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Adaptive Dynamic Programming Control #Smart Grid Energy Management
  11. Recursive Introspection: Teaching Language Model Agents How to Self-Improve
    2024/07/25 by Yu-Yuan Qu, Yuxiao Qu, Tianjun Zhang +6 · 1 voice · 31 citations
    Computer Science · #Multi-Agent Systems and Negotiation #Natural Language Processing Techniques #Topic Modeling #cs.AI #cs.CL #cs.LG
  12. Gemini: A Family of Highly Capable Multimodal Models
    2023/12/19 by Gemini Robotics Team, Rohan Anil, Gemini Team +2692 · 9 voices · 6 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #cs.AI #cs.CL #cs.CV
  13. Generative Verifiers: Reward Modeling as Next-Token Prediction
    2024/08/27 by Lunjun Zhang, Arian Hosseini, Zhang, Lunjun +9 · 115 citations
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Semantic Web and Ontologies #Topic Modeling
  14. Value-Based Deep RL Scales Predictably
    2025/02/06 by Oleh Rybkin, Michal Nauman, Rybkin, Oleh +11 · 9 voices · 6 citations
    Computer Science · Engineering · #Engineering Applied Research #Neural Networks and Applications #Technology and Data Analysis #cs.LG
  15. Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models
    2023/10/16 by Kevin Black, Black, Kevin, Mitsuhiko Nakamoto +11 · 73 citations
    Computer Science · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #Robotics (cs.RO)
  16. Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning
    2024/10/10 by Amrith Setlur, Chirag Nagpal, Setlur, Amrith +15 · 73 citations
    Business, Management and Accounting · Computer Science · #Business Process Modeling and Analysis #Semantic Web and Ontologies #Service-Oriented Architecture and Web Services
  17. Stop Regressing: Training Value Functions via Classification for Scalable Deep RL
    2024/03/06 by Jesse Farebrother, Jordi Orbay, Farebrother, Jesse +21 · 3 voices · 33 citations
    Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.AI #cs.LG #stat.ML
  18. Cal-QL: Calibrated Offline RL Pre-Training for Efficient Online Fine-Tuning
    2023/03/09 by Mitsuhiko Nakamoto, Yuexiang Zhai, Nakamoto, Mitsuhiko +13 · 35 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Reinforcement Learning in Robotics #Software Engineering Research
  19. DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning
    2024/06/14 by Bai, Hao, Zhou, Yifei, Cemri, Mert +4 · 44 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  20. ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL
    2024/02/29 by Yifei Zhou, Andrea Zanette, Zhou, Yifei +7 · 37 citations
    Computer Science · #Natural Language Processing Techniques #Topic Modeling
  21. COMBO: Conservative Offline Model-Based Policy Optimization
    2021/02/16 by Tianhe Yu, Yu, Tianhe, Aviral Kumar +9 · 25 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Adversarial Robustness in Machine Learning #Advanced Bandit Algorithms Research
  22. Implicit Under-Parameterization Inhibits Data-Efficient Deep\n Reinforcement Learning
    2020/10/27 by Aviral Kumar, Kumar, Aviral, Rishabh Agarwal +5 · 16 citations
    Computer Science · Engineering · #FOS: Computer and information sciences #Ferroelectric and Negative Capacitance Devices #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques
  23. Preference Fine-Tuning of LLMs Should Leverage Suboptimal, On-Policy Data
    2024/04/22 by Fahim Tajwar, Tajwar, Fahim, Anikait Singh +15 · 26 citations
    Decision Sciences · Economics, Econometrics and Finance · #Efficiency Analysis Using DEA #Healthcare Policy and Management #Auction Theory and Applications
  24. Why Generalization in RL is Difficult: Epistemic POMDPs and Implicit Partial Observability
    2021/07/13 by Dibya Ghosh, Ghosh, Dibya, Jad Rahme +9 · 14 citations
    Computer Science · #Reinforcement Learning in Robotics #Machine Learning and Algorithms #Adversarial Robustness in Machine Learning
  25. Q-Transformer: Scalable Offline Reinforcement Learning via Autoregressive Q-Functions
    2023/09/18 by Yevgen Chebotar, Quan Vuong, Chebotar, Yevgen +47 · 20 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO)
  26. OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning
    2020/10/26 by Anurag Ajay, Aviral Kumar, Ajay, Anurag +7 · 11 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics
  27. Steering Your Generalists: Improving Robotic Foundation Models via Value Guidance
    2024/10/17 by Mitsuhiko Nakamoto, Nakamoto, Mitsuhiko, Oier Mees +5 · 27 citations
    Computer Science · Decision Sciences · #Semantic Web and Ontologies #Simulation Techniques and Applications #Model-Driven Software Engineering Techniques
  28. RL on Incorrect Synthetic Data Scales the Efficiency of LLM Math Reasoning by Eight-Fold
    2024/06/20 by Amrith Setlur, Saurabh K. Garg†, Setlur, Amrith +9 · 21 citations
    Computer Science · #Educational Technology and Assessment
  29. Offline Q-Learning on Diverse Multi-Task Data Both Scales And Generalizes
    2022/11/28 by Aviral Kumar, Rishabh Agarwal, Kumar, Aviral +7 · 13 citations
    Computer Science · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
  30. Policy Agnostic RL: Offline RL and Online RL Fine-Tuning of Any Class and Backbone
    2024/12/09 by Max Sobol Mark, Tian Gao, Mark, Max Sobol +11 · 1 voice · 20 citations
    #cs.LG #cs.AI
  31. Is Value Learning Really the Main Bottleneck in Offline RL?
    2024/06/13 by Seohong Park, Park, Seohong, Kevin Frans +5 · 19 citations
    Business, Management and Accounting · #Artificial Intelligence (cs.AI) #ERP Systems Implementation and Impact #FOS: Computer and information sciences #Machine Learning (cs.LG)
  32. Conservative Safety Critics for Exploration
    2020/10/27 by Homanga Bharadhwaj, Aviral Kumar, Bharadhwaj, Homanga +9 · 8 citations
    Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO)
  33. Scaling Test-Time Compute Without Verification or RL is Suboptimal
    2025/02/17 by Amrith Setlur, Setlur, Amrith, Nived Rajaraman +5 · 25 citations
    Computer Science · #Embedded Systems Design Techniques #Parallel Computing and Optimization Techniques #Software Testing and Debugging Techniques
  34. When Should We Prefer Offline Reinforcement Learning Over Behavioral Cloning?
    2022/04/12 by Aviral Kumar, Joey Hong, Kumar, Aviral +5 · 8 citations
    Computer Science · #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural Networks and Reservoir Computing #Reinforcement Learning in Robotics
  35. Pre-Training for Robots: Offline RL Enables Learning New Tasks from a Handful of Trials
    2022/10/11 by Aviral Kumar, Kumar, Aviral, Anikait Singh +10 · 9 citations
    Computer Science · Medicine · #Advanced Neural Network Applications #COVID-19 diagnosis using AI #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  36. RRM: Robust Reward Model Training Mitigates Reward Hacking
    2024/09/20 by Tianqi Liu, Liu, Tianqi, Wei Xiong +33 · 16 citations
    Psychology · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Human-Automation Interaction and Safety
  37. Diagnosing Bottlenecks in Deep Q-learning Algorithms
    2019/02/26 by Justin Fu, Aviral Kumar, Fu, Justin +5 · 9 citations
    Computer Science · Engineering · #Advancements in Semiconductor Devices and Circuit Design #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  38. Graph Normalizing Flows
    2019/05/30 by Jenny Liu, Liu, Jenny, Aviral Kumar +7 · 8 citations
    Computer Science · #Advanced Graph Neural Networks #FOS: Computer and information sciences #Graph Theory and Algorithms #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Topic Modeling
  39. Optimizing Test-Time Compute via Meta Reinforcement Fine-Tuning
    2025/03/10 by Qu, Yuxiao, Yang, Matthew Y. R., Setlur, Amrith +4 · 27 citations
    #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  40. Unfamiliar Finetuning Examples Control How Language Models Hallucinate
    2024/03/08 by Katie Kang, Kang, Katie, Eric Wallace +7 · 11 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques
  41. Grounded Reinforcement Learning for Visual Reasoning
    2025/05/29 by Sarch, Gabriel, Saha, Snigdha, Khandelwal, Naitik +4 · 26 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  42. Efficient Online Reinforcement Learning Fine-Tuning Need Not Retain Offline Data
    2024/12/10 by Zhiyuan Zhou, Zhou, Zhiyuan, Qiyang Li +6 · 15 citations
    Business, Management and Accounting · #Digital Platforms and Economics
  43. Conservative Data Sharing for Multi-Task Offline Reinforcement Learning
    2021/09/16 by Tianhe Yu, Aviral Kumar, Yu, Tianhe +9 · 5 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO)
  44. DR3: Value-Based Deep Reinforcement Learning Requires Explicit Regularization
    2021/12/09 by Aviral Kumar, Rishabh Agarwal, Kumar, Aviral +9 · 6 citations
    Computer Science · #Reinforcement Learning in Robotics #Domain Adaptation and Few-Shot Learning #Machine Learning and ELM
  45. Conservative Objective Models for Effective Offline Model-Based Optimization
    2021/07/14 by Brandon Trabucco, Trabucco, Brandon, Aviral Kumar +5 · 6 citations
    Decision Sciences · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Simulation Techniques and Applications
  46. One Solution is Not All You Need: Few-Shot Extrapolation via Structured MaxEnt RL
    2020/10/27 by Saurabh Kumar, Kumar, Saurabh, Aviral Kumar +5 · 4 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
  47. Reward-Conditioned Policies
    2019/12/31 by Kumar, Aviral, Peng, Xue Bin, Levine, Sergey · 4 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  48. e3: Learning to Explore Enables Extrapolation of Test-Time Compute for LLMs
    2025/06/10 by Setlur, Amrith, Yang, Matthew Y. R., Snell, Charlie +5 · 21 citations
    #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  49. Design-Bench: Benchmarks for Data-Driven Offline Model-Based Optimization
    2022/02/17 by Trabucco, Brandon, Geng, Xinyang, Kumar, Aviral +1 · 4 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  50. Efficient Deep Reinforcement Learning Requires Regulating Overfitting
    2023/04/20 by Qiyang Li, Aviral Kumar, Li, Qiyang +5 · 5 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  51. Model Inversion Networks for Model-Based Optimization
    2019/12/31 by Kumar, Aviral, Levine, Sergey · 3 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  52. DisCor: Corrective Feedback in Reinforcement Learning via Distribution Correction
    2020/03/16 by Kumar, Aviral, Gupta, Abhishek, Levine, Sergey · 3 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  53. Action-Quantized Offline Reinforcement Learning for Robotic Skill Learning
    2023/10/18 by Jianlan Luo, Luo, Jianlan, Perry Dong +9 · 5 citations
    Computer Science · Neuroscience · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Neuroscience and Neural Engineering #Reinforcement Learning in Robotics
  54. How to Leverage Unlabeled Data in Offline Reinforcement Learning
    2022/02/03 by Tianhe Yu, Yu, Tianhe, Aviral Kumar +9 · 3 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robotics (cs.RO)
  55. Thinking vs. Doing: Agents that Reason by Scaling Test-Time Interaction
    2025/06/09 by Shen, Junhong, Bai, Hao, Zhang, Lunjun +8 · 15 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  56. Robotic Offline RL from Internet Videos via Value-Function Pre-Training
    2023/09/22 by Bhateja, Chethan, Guo, Derek, Ghosh, Dibya +6 · 4 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  57. A Workflow for Offline Model-Free Robotic Reinforcement Learning
    2021/09/22 by Aviral Kumar, Kumar, Aviral, Anikait Singh +7 · 3 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Machine Learning and Algorithms #Advanced Bandit Algorithms Research
  58. Don't Start From Scratch: Leveraging Prior Data to Automate Robotic Reinforcement Learning
    2022/07/11 by Walke, Homer, Yang, Jonathan, Yu, Albert +4 · 3 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  59. Data-Driven Offline Decision-Making via Invariant Representation Learning
    2022/11/21 by Qi, Han, Su, Yi, Kumar, Aviral +1 · 3 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  60. Calibration of Encoder Decoder Models for Neural Machine Translation
    2019/03/03 by Kumar, Aviral, Sarawagi, Sunita · 2 citations
    #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  61. Vision-Language Models Provide Promptable Representations for Reinforcement Learning
    2024/02/05 by William Chen, Oier Mees, Chen, William +5 · 4 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics
  62. What Do Learning Dynamics Reveal About Generalization in LLM Reasoning?
    2024/11/12 by Katie Kang, Amrith Setlur, Kang, Katie +11 · 6 citations
    Computer Science · #AI-based Problem Solving and Planning #FOS: Computer and information sciences #Intelligent Tutoring Systems and Adaptive Learning #Machine Learning (cs.LG) #Natural Language Processing Techniques
  63. Data-Driven Offline Optimization For Architecting Hardware Accelerators
    2021/10/20 by Aviral Kumar, Amir Yazdanbakhsh, Kumar, Aviral +7 · 2 citations
    Computer Science · Decision Sciences · #Advanced Data Storage Technologies #FOS: Computer and information sciences #Hardware Architecture (cs.AR) #Machine Learning (cs.LG) #Parallel Computing and Optimization Techniques #Simulation Techniques and Applications
  64. Horizon Reduction Makes RL Scalable
    2025/06/04 by Seohong Park, Park, Seohong, Kevin Frans +8 · 12 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques
  65. COG: Connecting New Skills to Past Experience with Offline Reinforcement Learning
    2020/10/27 by Avi Singh, Albert S. Yu, Singh, Avi +9 · 7 citations
    Engineering · Computer Science · #Robot Manipulation and Learning #Reinforcement Learning in Robotics #Machine Learning and Algorithms
  66. Digi-Q: Learning Q-Value Functions for Training Device-Control Agents
    2025/02/13 by Bai, Hao, Zhou, Yifei, Li, Li Erran +2 · 5 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  67. Bigger, Regularized, Categorical: High-Capacity Value Functions are Efficient Multi-Task Learners
    2025/05/29 by Michal Nauman, Marek Cygan, Nauman, Michal +7 · 7 citations
    Computer Science · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics
  68. Reasoning as an Adaptive Defense for Safety
    2025/07/01 by Taeyoun Kim, Fahim Tajwar, Kim, Taeyoun +5 · 9 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Security and Verification in Computing #Software Testing and Debugging Techniques
  69. RLAD: Training LLMs to Discover Abstractions for Solving Reasoning Problems
    2025/10/02 by Yuzhong Qu, Anikait Singh, Qu, Yuxiao +11 · 4 citations
    Social Sciences · Computer Science · #Artificial Intelligence in Law #Software Engineering Research #Natural Language Processing Techniques
  70. Confidence-Conditioned Value Functions for Offline Reinforcement Learning
    2022/12/08 by Joey Hong, Aviral Kumar, Hong, Joey +3 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
  71. D5RL: Diverse Datasets for Data-Driven Deep Reinforcement Learning
    2024/08/15 by Rafael Rafailov, Kyle Hatch, Rafailov, Rafael +21 · 2 citations
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robotics (cs.RO)
  72. Latent Conservative Objective Models for Data-Driven Crystal Structure Prediction
    2023/10/16 by Qi Han, Xinyang Geng, Qi, Han +9 · 1 citation
    Biochemistry, Genetics and Molecular Biology · Computer Science · Materials Science · #Computational Drug Discovery Methods #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning in Materials Science #Protein Structure and Dynamics
  73. RaC: Robot Learning for Long-Horizon Tasks by Scaling Recovery and Correction
    2025/09/09 by Zheyuan Hu, Hu, Zheyuan, Ruilian Wu +11 · 5 citations
    Computer Science · Engineering · Psychology · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO) #Social Robot Interaction and HRI