vix.ing · top · new · best · stats · spec

Yang, Tianpei

  1. A Survey on Interpretable Reinforcement Learning
    2021/12/24 by Claire Glanois, Paul Weng, Glanois, Claire +11 · 12 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #I.2.6 #Machine Learning (cs.LG)
  2. Action Semantics Network: Considering the Effects of Actions in Multiagent Systems
    2019/07/26 by Wang, Weixun, Yang, Tianpei, Liu, Yong +6 · 3 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multiagent Systems (cs.MA)
  3. SafeDialBench: A Fine-Grained Safety Evaluation Benchmark for Large Language Models in Multi-Turn Dialogues with Diverse Jailbreak Attacks
    2025/02/16 by Hongye Cao, Sijia Jing, Cao, Hongye +30 · 9 citations
    Health Professions · Psychology · Computer Science · #Interpreting and Communication in Healthcare #Deception detection and forensic psychology #Topic Modeling
  4. Learning to Shape Rewards using a Game of Two Partners
    2021/03/16 by David Mguni, Taher Jafferjee, Mguni, David +19 · 2 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Data Stream Mining Techniques
  5. PMIC: Improving Multi-Agent Reinforcement Learning with Progressive\n Mutual Information Collaboration
    2022/03/16 by Pengyi Li, Li, Pengyi, Tang, Hongyao +16 · 2 citations
    Biochemistry, Genetics and Molecular Biology · Computer Science · Engineering · Psychology · #Action Observation and Synchronization #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Insect and Arachnid Ecology and Behavior #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Robot Manipulation and Learning
  6. The Evolving Landscape of LLM- and VLM-Integrated Reinforcement Learning
    2025/02/21 by Schoepp, Sheila, Jafaripour, Masoud, Cao, Yingyue +6 · 5 citations
    #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  7. Efficient Last-iterate Convergence Algorithms in Solving Games
    2023/08/22 by Linjian Meng, Meng, Linjian, Zhenxing Ge +11 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Game Theory and Applications #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  8. From Few to More: Large-scale Dynamic Multiagent Curriculum Learning
    2019/09/06 by Wang, Weixun, Yang, Tianpei, Liu, Yong +6 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multiagent Systems (cs.MA)
  9. MDTeamGPT: A Self-Evolving LLM-based Multi-Agent Framework for Multi-Disciplinary Team Medical Consultation
    2025/03/18 by Chen, Kai, Li, Xinfeng, Yang, Tianpei +3 · 4 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
  10. MedSentry: Understanding and Mitigating Safety Risks in Medical LLM Multi-Agent Systems
    2025/05/27 by Kai Chen, Taihang Zhen, Chen, Kai +17 · 4 citations
    Biochemistry, Genetics and Molecular Biology · Computer Science · Health Professions · #Artificial Intelligence (cs.AI) #Biomedical Text Mining and Ontologies #Electronic Health Records Systems #FOS: Computer and information sciences #Multiagent Systems (cs.MA) #Semantic Web and Ontologies
  11. LaFFi: Leveraging Hybrid Natural Language Feedback for Fine-tuning Language Models
    2023/12/31 by Li, Qianxi, Cao, Yingyue, Kang, Jikun +4 · 1 citation
    #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  12. Faster Game Solving via Asymmetry of Step Sizes
    2025/03/17 by Linjian Meng, Tianpei Yang, Meng, Linjian +7 · 1 citation
    Decision Sciences · Computer Science · #Game Theory and Applications #Advanced Bandit Algorithms Research #Reinforcement Learning in Robotics