Stephen McAleer
- Mastering the game of Stratego with model-free multiagent reinforcement learning
2022/06/30 by Julien Pérolat, Julien Perolat, Bart de Vylder +38 · 6 voices · 21 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Artificial Intelligence in Games #Advanced Bandit Algorithms Research
- Llemma: An Open Language Model For Mathematics
2023/10/16 by Zhangir Azerbayev, Azerbayev, Zhangir, Hailey Schoelkopf +15 · 2 voices · 46 citations
#cs.CL #cs.AI #cs.LO
- Language Models can Solve Computer Tasks
2023/03/30 by Geunwoo Kim, Pierre Baldi, Kim, Geunwoo +3 · 45 citations
Computer Science · #Topic Modeling #Reinforcement Learning in Robotics #Multimodal Machine Learning Applications
- Solving the Rubik's Cube Without Human Knowledge
2018/05/18 by Stephen McAleer, Forest Agostinelli, McAleer, Stephen +5 · 3 voices · 1 citation
Computer Science · Social Sciences · #Artificial Intelligence in Games #Digital Games and Media #Reinforcement Learning in Robotics #cs.AI
- Tree Search for Language Model Agents
2024/07/01 by Jing Yu Koh, Stephen McAleer, Koh, Jing Yu +5 · 26 citations
Computer Science · #Natural Language Processing Techniques #Semantic Web and Ontologies #Topic Modeling
- Confronting Reward Model Overoptimization with Constrained RLHF
2023/10/06 by Ted Moskovitz, Aaditya K. Singh, Moskovitz, Ted +11 · 13 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling
- A* Search Without Expansions: Learning Heuristic Functions with Deep Q-Networks
2021/02/08 by Forest Agostinelli, Agostinelli, Forest, Shahaf S. Shperberg +9 · 2 voices
#cs.AI #cs.LG
- Pipeline PSRO: A Scalable Approach for Finding Approximate Nash Equilibria in Large Games
2020/06/15 by Stephen McAleer, McAleer, Stephen, John B. Lanier +5 · 4 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- XDO: A Double Oracle Algorithm for Extensive-Form Games
2021/03/11 by Stephen McAleer, McAleer, Stephen, John B. Lanier +6 · 3 citations
Computer Science · Economics, Econometrics and Finance · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Sports Analytics and Performance
- Grasper: A Generalist Pursuer for Pursuit-Evasion Problems
2024/04/19 by Pengdeng Li, Shuxin Li, Li, Pengdeng +13 · 6 citations
Engineering · #Guidance and Control Systems #Military Defense Systems Analysis
- ASP: Learn a Universal Neural Solver!
2023/03/01 by Chenguang Wang, Zhouliang Yu, Wang, Chenguang +7 · 3 citations
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning and Algorithms #Metaheuristic Optimization Algorithms Research #Optimization and Control (math.OC) #Vehicle Routing Optimization Methods
- Curiosity-Driven Multi-Criteria Hindsight Experience Replay
2019/06/09 by John B. Lanier, Stephen McAleer, Lanier, John B. +3 · 2 citations
Computer Science · Psychology · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Psychological and Educational Research Studies #Robotics (cs.RO) #Social Robot Interaction and HRI #Visual Attention and Saliency Detection
- Faster Game Solving via Hyperparameter Schedules
2024/04/13 by Naifeng Zhang, Stephen McAleer, Zhang, Naifeng +3 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Risk and Portfolio Optimization
- Computing Optimal Equilibria and Mechanisms via Learning in Zero-Sum Extensive-Form Games
2023/06/08 by Brian Hu Zhang, Zhang, Brian Hu, Gabriele Farina +17 · 2 citations
Decision Sciences · Economics, Econometrics and Finance · Social Sciences · #Auction Theory and Applications #Computer Science and Game Theory (cs.GT) #Experimental Behavioral Economics Studies #FOS: Computer and information sciences #Sports Analytics and Performance
- AgentKit: Structured LLM Reasoning with Dynamic Graphs
2024/04/17 by Yue Wu, Wu, Yue, Yewen Fan +15 · 2 citations
Computer Science · Decision Sciences · #Artificial Intelligence (cs.AI) #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multi-Agent Systems and Negotiation #Peer-to-Peer Network Technologies
- Self-Play PSRO: Toward Optimal Populations in Two-Player Zero-Sum Games
2022/07/13 by Stephen McAleer, McAleer, Stephen, JB Lanier +9 · 1 citation
Computer Science · #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- JiangJun: Mastering Xiangqi by Tackling Non-Transitivity in Two-Player Zero-Sum Games
2023/08/09 by Yang Li, Li, Yang, Kun Xiong +15 · 1 citation
Computer Science · Economics, Econometrics and Finance · Psychology · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Gambling Behavior and Treatments #Sports Analytics and Performance
- Steering No-Regret Learners to a Desired Equilibrium
2023/06/08 by Brian Hu Zhang, Zhang, Brian Hu, Gabriele Farina +17 · 1 citation
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Advanced Control Systems Optimization #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Intelligent Tutoring Systems and Adaptive Learning
- Scalable Mechanism Design for Multi-Agent Path Finding
2024/01/30 by Paul Friedrich, Yulun Zhang, Friedrich, Paul +13 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Multi-Agent Systems and Negotiation #Multiagent Systems (cs.MA) #Robotic Path Planning Algorithms
- Regret-Minimizing Double Oracle for Extensive-Form Games
2023/04/20 by Xiaohang Tang, Le Cong Dinh, Tang, Xiaohang +5 · 1 citation
Decision Sciences · Computer Science · Psychology · #Advanced Bandit Algorithms Research #Artificial Intelligence in Games #Gambling Behavior and Treatments