Sullivan, Ryan
- PettingZoo: Gym for Multi-Agent Reinforcement Learning
2020/09/30 by Justin K. Terry, Benjamin Black, Terry, J. K. +23 · 27 citations
Computer Science · #Reinforcement Learning in Robotics #Artificial Intelligence in Games #Evolutionary Algorithms and Applications
- Conditional Language Policy: A General Framework for Steerable Multi-Objective Finetuning
2024/07/22 by Kaiwen Wang, Rahul Kidambi, Wang, Kaiwen +36 · 8 citations
Arts and Humanities · Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Linguistic research and analysis #Machine Learning (cs.LG) #Natural Language Processing Techniques #Syntax, Semantics, Linguistic Variation
- Robust Multi-Objective Preference Alignment with Online DPO
2025/03/01 by Gupta, Raghav, Sullivan, Ryan, Li, Yunxuan +2 · 7 citations
#Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Open RL Benchmark: Comprehensive Tracked Experiments for Reinforcement Learning
2024/02/05 by Huang, Shengyi, Gallouédec, Quentin, Felten, Florian +30 · 3 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- Neural MMO 2.0: A Massively Multi-task Addition to Massively Multi-agent Learning
2023/11/07 by Suárez, Joseph, Isola, Phillip, Choe, Kyoung Whan +15 · 2 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA)
- Gradient Informed Proximal Policy Optimization
2023/12/14 by Sanghyun Son, Laura Zheng, Son, Sanghyun +7 · 2 citations
Computer Science · #Advanced Neural Network Applications #Machine Learning and Data Classification #Age of Information Optimization
- MS Lesion Segmentation: Revisiting Weighting Mechanisms for Federated Learning
2022/05/03 by Dongnan Liu, Mariano Cabezas, Liu, Dongnan +35 · 1 citation
Computer Science · Medicine · Biochemistry, Genetics and Molecular Biology · #AI in cancer detection #Cutaneous Melanoma Detection and Management #Gene expression and cancer classification
- Reward Scale Robustness for Proximal Policy Optimization via DreamerV3 Tricks
2023/10/26 by Ryan Sullivan, Akarsh Kumar, Sullivan, Ryan +7 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics