vix.ing · top · new · best · stats · spec

Stephen McAleer

  1. Mastering the game of Stratego with model-free multiagent reinforcement learning
    2022/06/30 by Julien Pérolat, Julien Perolat, Bart de Vylder +38 · 6 voices · 21 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Artificial Intelligence in Games #Advanced Bandit Algorithms Research
  2. Llemma: An Open Language Model For Mathematics
    2023/10/16 by Zhangir Azerbayev, Azerbayev, Zhangir, Hailey Schoelkopf +15 · 2 voices · 46 citations
    #cs.CL #cs.AI #cs.LO
  3. Language Models can Solve Computer Tasks
    2023/03/30 by Geunwoo Kim, Pierre Baldi, Kim, Geunwoo +3 · 45 citations
    Computer Science · #Topic Modeling #Reinforcement Learning in Robotics #Multimodal Machine Learning Applications
  4. Solving the Rubik's Cube Without Human Knowledge
    2018/05/18 by Stephen McAleer, Forest Agostinelli, McAleer, Stephen +5 · 3 voices · 1 citation
    Computer Science · Social Sciences · #Artificial Intelligence in Games #Digital Games and Media #Reinforcement Learning in Robotics #cs.AI
  5. Tree Search for Language Model Agents
    2024/07/01 by Jing Yu Koh, Stephen McAleer, Koh, Jing Yu +5 · 26 citations
    Computer Science · #Natural Language Processing Techniques #Semantic Web and Ontologies #Topic Modeling
  6. Confronting Reward Model Overoptimization with Constrained RLHF
    2023/10/06 by Ted Moskovitz, Aaditya K. Singh, Moskovitz, Ted +11 · 13 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling
  7. A* Search Without Expansions: Learning Heuristic Functions with Deep Q-Networks
    2021/02/08 by Forest Agostinelli, Agostinelli, Forest, Shahaf S. Shperberg +9 · 2 voices
    #cs.AI #cs.LG
  8. Pipeline PSRO: A Scalable Approach for Finding Approximate Nash Equilibria in Large Games
    2020/06/15 by Stephen McAleer, McAleer, Stephen, John B. Lanier +5 · 4 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  9. XDO: A Double Oracle Algorithm for Extensive-Form Games
    2021/03/11 by Stephen McAleer, McAleer, Stephen, John B. Lanier +6 · 3 citations
    Computer Science · Economics, Econometrics and Finance · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Sports Analytics and Performance
  10. Grasper: A Generalist Pursuer for Pursuit-Evasion Problems
    2024/04/19 by Pengdeng Li, Shuxin Li, Li, Pengdeng +13 · 6 citations
    Engineering · #Guidance and Control Systems #Military Defense Systems Analysis
  11. ASP: Learn a Universal Neural Solver!
    2023/03/01 by Chenguang Wang, Zhouliang Yu, Wang, Chenguang +7 · 3 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning and Algorithms #Metaheuristic Optimization Algorithms Research #Optimization and Control (math.OC) #Vehicle Routing Optimization Methods
  12. Curiosity-Driven Multi-Criteria Hindsight Experience Replay
    2019/06/09 by John B. Lanier, Stephen McAleer, Lanier, John B. +3 · 2 citations
    Computer Science · Psychology · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Psychological and Educational Research Studies #Robotics (cs.RO) #Social Robot Interaction and HRI #Visual Attention and Saliency Detection
  13. Faster Game Solving via Hyperparameter Schedules
    2024/04/13 by Naifeng Zhang, Stephen McAleer, Zhang, Naifeng +3 · 3 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Risk and Portfolio Optimization
  14. Computing Optimal Equilibria and Mechanisms via Learning in Zero-Sum Extensive-Form Games
    2023/06/08 by Brian Hu Zhang, Zhang, Brian Hu, Gabriele Farina +17 · 2 citations
    Decision Sciences · Economics, Econometrics and Finance · Social Sciences · #Auction Theory and Applications #Computer Science and Game Theory (cs.GT) #Experimental Behavioral Economics Studies #FOS: Computer and information sciences #Sports Analytics and Performance
  15. AgentKit: Structured LLM Reasoning with Dynamic Graphs
    2024/04/17 by Yue Wu, Wu, Yue, Yewen Fan +15 · 2 citations
    Computer Science · Decision Sciences · #Artificial Intelligence (cs.AI) #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multi-Agent Systems and Negotiation #Peer-to-Peer Network Technologies
  16. Self-Play PSRO: Toward Optimal Populations in Two-Player Zero-Sum Games
    2022/07/13 by Stephen McAleer, McAleer, Stephen, JB Lanier +9 · 1 citation
    Computer Science · #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  17. JiangJun: Mastering Xiangqi by Tackling Non-Transitivity in Two-Player Zero-Sum Games
    2023/08/09 by Yang Li, Li, Yang, Kun Xiong +15 · 1 citation
    Computer Science · Economics, Econometrics and Finance · Psychology · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Gambling Behavior and Treatments #Sports Analytics and Performance
  18. Steering No-Regret Learners to a Desired Equilibrium
    2023/06/08 by Brian Hu Zhang, Zhang, Brian Hu, Gabriele Farina +17 · 1 citation
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Advanced Control Systems Optimization #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Intelligent Tutoring Systems and Adaptive Learning
  19. Scalable Mechanism Design for Multi-Agent Path Finding
    2024/01/30 by Paul Friedrich, Yulun Zhang, Friedrich, Paul +13 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Multi-Agent Systems and Negotiation #Multiagent Systems (cs.MA) #Robotic Path Planning Algorithms
  20. Regret-Minimizing Double Oracle for Extensive-Form Games
    2023/04/20 by Xiaohang Tang, Le Cong Dinh, Tang, Xiaohang +5 · 1 citation
    Decision Sciences · Computer Science · Psychology · #Advanced Bandit Algorithms Research #Artificial Intelligence in Games #Gambling Behavior and Treatments