vix.ing · top · new · best · stats · spec

Jiaming Ji

  1. Safe RLHF: Safe Reinforcement Learning from Human Feedback
    2023/10/19 by Josef Dai, Xuehai Pan, Dai, Josef +13 · 108 citations
    Computer Science · #Software Engineering Research #Explainable Artificial Intelligence (XAI) #Topic Modeling
  2. PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
    2024/06/20 by Jiaming Ji, Ji, Jiaming, Donghai Hong +16 · 52 citations
    Computer Science · #Natural Language Processing Techniques #Software Engineering Research
  3. Aligner: Efficient Alignment by Learning to Correct
    2024/02/04 by Jiaming Ji, Ji, Jiaming, Boyuan Chen +13 · 27 citations
    Computer Science · Physics and Astronomy · #Handwritten Text Recognition Techniques #Color Science and Applications
  4. Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
    2023/10/19 by Jiaming Ji, Borong Zhang, Ji, Jiaming +17 · 21 citations
    Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  5. Heterogeneous-Agent Reinforcement Learning
    2023/04/19 by Yifan Zhong, Jakub Grudzien Kuba, Zhong, Yifan +8 · 19 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  6. Language Models Resist Alignment: Evidence From Data Compression
    2024/06/10 by Jiaming Ji, Ji, Jiaming, Kaile Wang +14 · 13 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques
  7. SafeDreamer: Safe Reinforcement Learning with World Models
    2023/07/14 by Weidong Huang, Jiaming Ji, Huang, Weidong +7 · 10 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Anomaly Detection Techniques and Applications #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  8. OmniSafe: An Infrastructure for Accelerating Safe Reinforcement Learning Research
    2023/05/16 by Jiaming Ji, Jiayi Zhou, Ji, Jiaming +17 · 9 citations
    Computer Science · Social Sciences · Health Professions · #Adversarial Robustness in Machine Learning #Ethics and Social Impacts of AI #Occupational Health and Safety Research
  9. A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment
    2025/04/22 by Kun Wang, Guibin Zhang, Wang, Kun +193 · 28 citations
    Computer Science · Health Professions · Medicine · #Adversarial Robustness in Machine Learning #Occupational Health and Safety Research #Artificial Intelligence in Healthcare and Education
  10. SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning
    2025/03/05 by Borong Zhang, Zhang, Borong, Yuhao Zhang +10 · 12 citations
    Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition
  11. Constrained Update Projection Approach to Safe Policy Optimization
    2022/09/15 by Yang Long, Yang, Long, Jiaming Ji +13 · 4 citations
    Computer Science · #Reinforcement Learning in Robotics #Software Reliability and Analysis Research
  12. SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset
    2024/06/20 by Josef Dai, Dai, Josef, Xuyao Wang +10 · 6 citations
    Computer Science · #Advanced Text Analysis Techniques #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #Databases (cs.DB) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling
  13. PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models
    2025/04/22 by Shi Qiu, Shaoyang Guo, Qiu, Shi +98 · 12 citations
    Computer Science · #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Online Learning and Analytics #Topic Modeling
  14. Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback
    2024/12/20 by Jiaming Ji, Ji, Jiaming, Jiayi Zhou +34 · 8 citations
    Computer Science · #Intelligent Tutoring Systems and Adaptive Learning #Speech and dialogue systems #Natural Language Processing Techniques
  15. RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?
    2025/01/20 by Haotian Xu, Xing Wu, Xu, Haotian +25 · 8 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  16. FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation
    2025/05/30 by Junyu Luo, Luo, Junyu, Zhizhuo Kou +23 · 10 citations
    Decision Sciences · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Stock Market Forecasting Methods
  17. RobustVLA: On Robustness of Vision-Language-Action Model against Multi-Modal Perturbations
    2025/09/26 by Jianing Guo, Zhenhong Wu, Guo, Jianing +29 · 4 citations
    #cs.CV #cs.AI #cs.RO
  18. Medical Reasoning in the Era of LLMs: A Systematic Review of Enhancement Techniques and Applications
    2025/08/01 by Wenxuan Wang, Zhongjun Ma, Wang, Wenxuan +16 · 3 citations
    Medicine · Computer Science · #Artificial Intelligence in Healthcare and Education #Machine Learning in Healthcare #Multimodal Machine Learning Applications
  19. A Game-Theoretic Negotiation Framework for Cross-Cultural Consensus in LLMs
    2025/06/16 by Guoxi Zhang, Zhang, Guoxi, Jiawei Chen +8 · 1 citation
    Business, Management and Accounting · #Outsourcing and Supply Chain Management
  20. Generative RLHF-V: Learning Principles from Multi-modal Human Preference
    2025/05/24 by Jiayi Zhou, Jiaming Ji, Zhou, Jiayi +14 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech and dialogue systems