vix.ing · top · new · best · stats · spec

Peter Stone

  1. LLM+P: Empowering Large Language Models with Optimal Planning Proficiency
    2023/04/22 by Bo Liu, Yuqian Jiang, Liu, Bo +11 · 1 voice · 64 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Multimodal Machine Learning Applications
  2. LIBERO: Benchmarking Knowledge Transfer for Lifelong Robot Learning
    2023/06/05 by Bo Liu, Liu, Bo, Yifeng Zhu +11 · 282 citations
    Computer Science · #Domain Adaptation and Few-Shot Learning #Multimodal Machine Learning Applications
  3. Deep Recurrent Q-Learning for Partially Observable MDPs
    2015/07/23 by Matthew Hausknecht, Hausknecht, Matthew, Peter Stone +1 · 51 citations
    Computer Science · Physics and Astronomy · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Model Reduction and Neural Networks #Neural Networks and Reservoir Computing #Reinforcement Learning in Robotics
  4. Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes
    2024/08/07 by Chen Tang, Ben Abbatematteo, Tang, Chen +9 · 53 citations
    Computer Science · #Reinforcement Learning in Robotics
  5. Continual Learning and Private Unlearning
    2022/03/24 by Bo Liu, Liu, Bo, Qiang Liu +3 · 24 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences
  6. Bottom-Up Skill Discovery from Unsegmented Demonstrations for Long-Horizon Robot Manipulation
    2021/09/28 by Yifeng Zhu, Zhu, Yifeng, Peter Stone +3 · 19 citations
    Computer Science · Engineering · #FOS: Computer and information sciences #Human Pose and Action Recognition #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO)
  7. BOME! Bilevel Optimization Made Easy: A Simple First-Order Approach
    2022/09/19 by Mao Ye, Бо Лю, Ye, Mao +7 · 20 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC) #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques
  8. Principles and Guidelines for Evaluating Social Robot Navigation Algorithms
    2023/06/29 by Anthony Francis, Francis, Anthony, Claudia Pérez-D’Arpino +59 · 23 citations
    Psychology · #Social Robot Interaction and HRI
  9. FAMO: Fast Adaptive Multitask Optimization
    2023/06/06 by Bo Liu, Yihao Feng, Liu, Bo +5 · 16 citations
    Computer Science · #Advanced Neural Network Applications #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and ELM
  10. FLaRe: Achieving Masterful and Adaptive Robot Policies with Large-Scale Reinforcement Learning Fine-Tuning
    2024/09/25 by Jiaheng Hu, Hu, Jiaheng, Rose Hendrix +13 · 24 citations
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robotics (cs.RO)
  11. Deep Reinforcement Learning in Parameterized Action Space
    2015/11/13 by Matthew Hausknecht, Peter Stone, Hausknecht, Matthew +1 · 8 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Neural and Evolutionary Computing (cs.NE) #Reinforcement Learning in Robotics
  12. Learning Generalizable Manipulation Policies with Object-Centric 3D Representations
    2023/10/22 by Yifeng Zhu, Zhenyu Jiang, Zhu, Yifeng +5 · 11 citations
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Human Pose and Action Recognition #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Robotics (cs.RO)
  13. SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning
    2024/10/13 by Hojoon Lee, Lee, Hojoon, Dongyoon Hwang +16 · 16 citations
    Computer Science · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications
  14. Reward (Mis)design for Autonomous Driving
    2021/04/28 by W. Bradley Knox, Alessandro Allievi, Knox, W. Bradley +7 · 6 citations
    Business, Management and Accounting · Decision Sciences · Neuroscience · #91B16 #FOS: Computer and information sciences #I.2.6 #I.2.8 #I.2.9 #Innovation Diffusion and Forecasting #Machine Learning (cs.LG) #Neural and Behavioral Psychology Studies #Product Development and Customization
  15. The EMPATHIC Framework for Task Learning from Implicit Human Feedback
    2020/09/28 by Yuchen Cui, Qiping Zhang, Cui, Yuchen +9 · 5 citations
    Engineering · Psychology · #Emotion and Mood Recognition #FOS: Computer and information sciences #Human-Computer Interaction (cs.HC) #Robot Manipulation and Learning #Robotics (cs.RO) #Social Robot Interaction and HRI
  16. Causal Dynamics Learning for Task-Independent State Abstraction
    2022/06/27 by Zizhao Wang, Wang, Zizhao, Xuesu Xiao +7 · 6 citations
    Computer Science · Neuroscience · #Reinforcement Learning in Robotics #Age of Information Optimization #EEG and Brain-Computer Interfaces
  17. Longhorn: State Space Models are Amortized Online Learners
    2024/07/19 by Bo Liu, Liu, Bo, Rui Wang +9 · 10 citations
    Computer Science · #Intelligent Tutoring Systems and Adaptive Learning
  18. Rethinking Social Robot Navigation: Leveraging the Best of Two Worlds
    2023/09/23 by Amir Hossain Raj, Raj, Amir Hossain, Zichao Hu +15 · 8 citations
    Computer Science · Psychology · #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Robotics (cs.RO) #Social Robot Interaction and HRI
  19. LaRS: Latent Reasoning Skills for Chain-of-Thought Reasoning
    2023/12/07 by Zifan Xu, Xu, Zifan, Haozhu Wang +7 · 7 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Semantic Web and Ontologies
  20. Learning Inverse Kinodynamics for Accurate High-Speed Off-Road Navigation on Unstructured Terrain
    2021/02/25 by Xuesu Xiao, Xiao, Xuesu, Joydeep Biswas +3 · 5 citations
    Computer Science · Engineering · #Robotic Path Planning Algorithms #Robotics and Sensor-Based Localization #Robotic Locomotion and Control
  21. TeleMoMa: A Modular and Versatile Teleoperation System for Mobile Manipulation
    2024/03/12 by Shivin Dass, Dass, Shivin, Wensi Ai +15 · 7 citations
    Computer Science · Engineering · Neuroscience · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO) #Tactile and Sensory Interactions #Teleoperation and Haptic Systems #Virtual Reality Applications and Impacts
  22. Reinforcement Learning for Optimization of COVID-19 Mitigation policies
    2020/10/20 by Varun Raj Kompella, Roberto Capobianco, Kompella, Varun +13 · 3 citations
    Mathematics · Medicine · #Artificial Intelligence (cs.AI) #COVID-19 epidemiological studies #Computers and Society (cs.CY) #FOS: Computer and information sciences #Influenza Virus Research Studies #Machine Learning (cs.LG) #SARS-CoV-2 and COVID-19 Research
  23. Firefly Neural Architecture Descent: a General Approach for Growing\n Neural Networks
    2021/02/16 by Lemeng Wu, Wu, Lemeng, Bo Liu +5 · 4 citations
    Computer Science · #Advanced Neural Network Applications #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications
  24. Deterministic Implementations for Reproducibility in Deep Reinforcement\n Learning
    2018/09/15 by Prabhat Nagarajan, Garrett Warnell, Nagarajan, Prabhat +3 · 3 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning and Data Classification #Reinforcement Learning in Robotics #Software Engineering Research
  25. Scalable Multiagent Driving Policies For Reducing Traffic Congestion
    2021/02/26 by Jiaxun Cui, William Macke, Cui, Jiaxun +6 · 3 citations
    Engineering · #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #FOS: Electrical engineering #Systems and Control (eess.SY) #Traffic control and management #Transportation and Mobility Innovations #electronic engineering #information engineering
  26. Dynamic Sparse Training for Deep Reinforcement Learning
    2021/06/08 by Ghada Sokar, Elena Mocanu, Sokar, Ghada +7 · 3 citations
    Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Fuel Cells and Related Materials #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  27. Disentangled Unsupervised Skill Discovery for Efficient Hierarchical Reinforcement Learning
    2024/10/15 by Jiaheng Hu, Zizhao Wang, Hu, Jiaheng +5 · 7 citations
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics #Robotics (cs.RO)
  28. SkiLD: Unsupervised Skill Discovery Guided by Factor Interactions
    2024/10/24 by Zizhao Wang, Wang, Zizhao, Jiaheng Hu +13 · 7 citations
    Computer Science · Social Sciences · #Educational Assessment and Pedagogy #Educational Technology and Assessment #FOS: Computer and information sciences #Higher Education Learning Practices #Machine Learning (cs.LG) #Robotics (cs.RO)
  29. A Super-human Vision-based Reinforcement Learning Agent for Autonomous Racing in Gran Turismo
    2024/06/18 by Miguel Vasco, Takuma Seno, Vasco, Miguel +8 · 5 citations
    Engineering · Computer Science · #Autonomous Vehicle Technology and Safety #Reinforcement Learning in Robotics
  30. An Architecture for Person-Following using Active Target Search
    2018/09/24 by Minkyu Kim, Miguel Arduengo, Kim, Minkyu +10 · 2 citations
    Computer Science · Engineering · #FOS: Computer and information sciences #Robotic Path Planning Algorithms #Robotics (cs.RO) #Robotics and Sensor-Based Localization #Video Surveillance and Tracking Methods
  31. AI-Assisted Peer Review at Scale: The AAAI-26 AI Review Pilot
    2026/04/15 by Joydeep Biswas, Sheila Schoepp, Gautham Vasan +10 · 7 voices · 4 citations
    #cs.AI
  32. Benchmarking Reinforcement Learning Techniques for Autonomous Navigation
    2022/10/10 by Zifan Xu, Xu, Zifan, Bo Liu +7 · 4 citations
    Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Robotics (cs.RO)
  33. Data-Efficient Policy Evaluation Through Behavior Policy Search
    2017/06/12 by Josiah P. Hanna, Philip S. Thomas, Hanna, Josiah P. +5 · 2 citations
    Computer Science · Business, Management and Accounting · #Reinforcement Learning in Robotics #Supply Chain and Inventory Management #Software Reliability and Analysis Research
  34. N-Agent Ad Hoc Teamwork
    2024/04/16 by Caroline Wang, Wang, Caroline, Arrasy Rahman +7 · 4 citations
    Computer Science · #Multi-Agent Systems and Negotiation
  35. Learning Perceptual Hallucination for Multi-Robot Navigation in Narrow Hallways
    2022/09/27 by Jin‐Soo Park, Xuesu Xiao, Park, Jin-Soo +7 · 3 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Anomaly Detection Techniques and Applications #FOS: Computer and information sciences #Robotics (cs.RO) #Topological and Geometric Data Analysis
  36. DM2: Decentralized Multi-Agent Reinforcement Learning for Distribution Matching
    2022/06/01 by Caroline Wang, Ishan Durugkar, Wang, Caroline +5 · 2 citations
    Computer Science · Social Sciences · #Artificial Intelligence (cs.AI) #Evolutionary Game Theory and Cooperation #Experimental Behavioral Economics Studies #FOS: Computer and information sciences #I.2.0 #I.2.11 #I.2.8 #I.2.9 #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Robotics (cs.RO)
  37. Dexterous Legged Locomotion in Confined 3D Spaces with Reinforcement Learning
    2024/03/06 by Zifan Xu, Amir Hossain Raj, Xu, Zifan +5 · 4 citations
    Engineering · #Architecture and Computational Design #FOS: Computer and information sciences #Machine Learning (cs.LG) #Modular Robots and Swarm Intelligence #Robotic Locomotion and Control #Robotics (cs.RO)
  38. Value Function Decomposition for Iterative Design of Reinforcement Learning Agents
    2022/06/24 by James MacGlashan, Evan Archer, MacGlashan, James +11 · 2 citations
    Business, Management and Accounting · Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Open Source Software Innovations #Software Engineering Research #Supply Chain and Inventory Management
  39. A Real-Time Model-Based Reinforcement Learning Architecture for Robot Control
    2011/05/09 by Todd Hester, Michael Quinlan, Hester, Todd +3 · 1 citation
    Computer Science · Engineering · #Advanced Control Systems Optimization #Artificial Intelligence (cs.AI) #D.2.11 #FOS: Computer and information sciences #I.2.6 #Reinforcement Learning in Robotics #Robotic Path Planning Algorithms #Robotics (cs.RO) #Software Engineering (cs.SE)
  40. From Agile Ground to Aerial Navigation: Learning from Learned Hallucination
    2021/08/22 by Zizhao Wang, Wang, Zizhao, Xuesu Xiao +13 · 2 citations
    Computer Science · #Artificial Intelligence in Games #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Robotic Path Planning Algorithms #Robotics (cs.RO)
  41. Hyperspherical Normalization for Scalable Deep Reinforcement Learning
    2025/02/21 by HoJoon Lee, Yongkyu Lee, Lee, Hojoon +9 · 5 citations
    Computer Science · #Reinforcement Learning in Robotics #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning
  42. Multi-Agent Inverse Reinforcement Learning in Real World Unstructured Pedestrian Crowds
    2024/05/26 by Rohan Chandra, Chandra, Rohan, Haresh Karnan +7 · 3 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Evacuation and Crowd Dynamics #FOS: Computer and information sciences #Human Motion and Animation #Human Pose and Action Recognition #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Robotics (cs.RO)
  43. ELDEN: Exploration via Local Dependencies
    2023/10/12 by Jiaheng Hu, Zizhao Wang, Hu, Jiaheng +5 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning in Healthcare #Reinforcement Learning in Robotics #Robotics (cs.RO)
  44. APPLI: Adaptive Planner Parameter Learning From Interventions
    2020/11/01 by Zizhao Wang, Xuesu Xiao, Wang, Zizhao +7 · 2 citations
    Computer Science · Engineering · #FOS: Computer and information sciences #Robot Manipulation and Learning #Robotic Path Planning Algorithms #Robotics (cs.RO) #Robotics and Sensor-Based Localization
  45. Toward Agile Maneuvers in Highly Constrained Spaces: Learning from Hallucination
    2020/07/28 by Xuesu Xiao, Bo Liu, Xiao, Xuesu +5 · 1 citation
    Computer Science · Engineering · #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotic Path Planning Algorithms #Robotics (cs.RO)
  46. Stochastic Grounded Action Transformation for Robot Learning in\n Simulation
    2020/08/03 by Siddharth Desai, Haresh Karnan, Desai, Siddharth +7 · 1 citation
    Computer Science · #FOS: Computer and information sciences #Machine Learning and Algorithms #Reinforcement Learning in Robotics #Robotics (cs.RO) #Topic Modeling
  47. Deadlock-free, Safe, and Decentralized Multi-Robot Navigation in Social Mini-Games via Discrete-Time Control Barrier Functions
    2023/08/21 by Rohan Chandra, Vrushabh Zinage, Chandra, Rohan +7 · 2 citations
    Computer Science · #Robotic Path Planning Algorithms #Reinforcement Learning in Robotics #Distributed Control Multi-Agent Systems
  48. RAIL: A modular framework for Reinforcement-learning-based Adversarial Imitation Learning
    2021/05/08 by Eddy Hudson, Hudson, Eddy, Garrett Warnell +3 · 1 citation
    Computer Science · Engineering · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Human Pose and Action Recognition #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robotic Locomotion and Control
  49. Effective Mutation Rate Adaptation through Group Elite Selection
    2022/04/11 by Akarsh Kumar, Kumar, Akarsh, Bo Liu +5 · 1 citation
    Computer Science · #Advanced Multi-Objective Optimization Algorithms #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Metaheuristic Optimization Algorithms Research #Neural and Evolutionary Computing (cs.NE)
  50. Dobby: A Conversational Service Robot Driven by GPT-4
    2023/10/10 by Carson Stark, Bohkyung Chun, Stark, Carson +15 · 1 citation
    Computer Science · Engineering · Psychology · #AI in Service Interactions #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Robotics (cs.RO) #Robotics and Automated Systems #Social Robot Interaction and HRI
  51. Benchmarking Massively Parallelized Multi-Task Reinforcement Learning for Robotics Tasks
    2025/07/31 by V. K. Joshi, Joshi, Viraj, Ziliang Xu +7 · 5 citations
    Computer Science · Engineering · #FOS: Computer and information sciences #Human Motion and Animation #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO)
  52. RLZero: Direct Policy Inference from Language Without In-Domain Supervision
    2024/12/07 by Harshit Sikchi, Siddhant Agarwal, Sikchi, Harshit +15 · 2 voices · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Graphics (cs.GR) #Machine Learning (cs.LG) #Robotics (cs.RO) #cs.AI #cs.GR #cs.LG #cs.RO
  53. CoopReflect: Towards Natural Language Communication for Cooperative Autonomous Driving via Multi-Agent Learning
    2025/05/23 by Jiaxun Cui, Chen Tang, Cui, Jiaxun +11 · 4 citations
    #cs.RO #cs.AI #cs.MA
  54. Multistep Inverse Is Not All You Need
    2024/03/18 by Alexander Levine, Levine, Alexander, Peter Stone +3 · 1 citation
    Computer Science · Physics and Astronomy · #Generative Adversarial Networks and Image Synthesis #Model Reduction and Neural Networks #Adversarial Robustness in Machine Learning
  55. f-Policy Gradients: A General Framework for Goal Conditioned RL using f-Divergences
    2023/10/10 by Siddhant Agarwal, Agarwal, Siddhant, Ishan Durugkar +5 · 1 citation
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Age of Information Optimization #Advanced Bandit Algorithms Research
  56. Sample Efficient Myopic Exploration Through Multitask Reinforcement Learning with Diverse Tasks
    2024/03/03 by Ziping Xu, Zifan Xu, Xu, Ziping +7 · 1 citation
    Computer Science · Engineering · #Advanced Vision and Imaging #FOS: Computer and information sciences #Image Enhancement Techniques #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optical Wireless Communication Technologies
  57. Composing Efficient, Robust Tests for Policy Selection
    2023/06/12 by Dustin Morrill, Morrill, Dustin, Thomas J. Walsh +7 · 1 citation
    Computer Science · Economics, Econometrics and Finance · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #B.8.1 #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #I.2.6 #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Sports Analytics and Performance
  58. Learning a Fast Mixing Exogenous Block MDP using a Single Trajectory
    2024/10/03 by Alexander Levine, Peter Stone, Levine, Alexander +3 · 1 citation
    Computer Science · #Algorithms and Data Compression #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Speech Recognition and Synthesis
  59. Learning Memory Mechanisms for Decision Making through Demonstrations
    2024/11/12 by William Yue, Yue, William, Bo Liu +3 · 1 citation
    Computer Science · #Artificial Intelligence in Games #Topic Modeling #Metaheuristic Optimization Algorithms Research
  60. Learning to Look: Seeking Information for Decision Making via Policy Factorization
    2024/10/24 by Shivin Dass, Dass, Shivin, Jiaheng Hu +7 · 1 citation
    Decision Sciences · #Complex Systems and Decision Making
  61. ROTATE: Regret-driven Open-ended Training for Ad Hoc Teamwork
    2025/05/29 by Caroline Wang, Arrasy Rahman, Wang, Caroline +7 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #I.2.1 #I.2.11 #I.2.6 #I.2.8 #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  62. LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks
    2026/07/26 by Faraz Heravi, James Ouyang, Zifan Xu +3
    #cs.RO