Jiaming Ji
- Safe RLHF: Safe Reinforcement Learning from Human Feedback
2023/10/19 by Josef Dai, Xuehai Pan, Dai, Josef +13 · 108 citations
Computer Science · #Software Engineering Research #Explainable Artificial Intelligence (XAI) #Topic Modeling
- PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
2024/06/20 by Jiaming Ji, Ji, Jiaming, Donghai Hong +16 · 52 citations
Computer Science · #Natural Language Processing Techniques #Software Engineering Research
- Aligner: Efficient Alignment by Learning to Correct
2024/02/04 by Jiaming Ji, Ji, Jiaming, Boyuan Chen +13 · 27 citations
Computer Science · Physics and Astronomy · #Handwritten Text Recognition Techniques #Color Science and Applications
- Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
2023/10/19 by Jiaming Ji, Borong Zhang, Ji, Jiaming +17 · 21 citations
Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Heterogeneous-Agent Reinforcement Learning
2023/04/19 by Yifan Zhong, Jakub Grudzien Kuba, Zhong, Yifan +8 · 19 citations
Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Language Models Resist Alignment: Evidence From Data Compression
2024/06/10 by Jiaming Ji, Ji, Jiaming, Kaile Wang +14 · 13 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques
- SafeDreamer: Safe Reinforcement Learning with World Models
2023/07/14 by Weidong Huang, Jiaming Ji, Huang, Weidong +7 · 10 citations
Computer Science · #Adversarial Robustness in Machine Learning #Anomaly Detection Techniques and Applications #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- OmniSafe: An Infrastructure for Accelerating Safe Reinforcement Learning Research
2023/05/16 by Jiaming Ji, Jiayi Zhou, Ji, Jiaming +17 · 9 citations
Computer Science · Social Sciences · Health Professions · #Adversarial Robustness in Machine Learning #Ethics and Social Impacts of AI #Occupational Health and Safety Research
- A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment
2025/04/22 by Kun Wang, Guibin Zhang, Wang, Kun +193 · 28 citations
Computer Science · Health Professions · Medicine · #Adversarial Robustness in Machine Learning #Occupational Health and Safety Research #Artificial Intelligence in Healthcare and Education
- SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning
2025/03/05 by Borong Zhang, Zhang, Borong, Yuhao Zhang +10 · 12 citations
Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition
- Constrained Update Projection Approach to Safe Policy Optimization
2022/09/15 by Yang Long, Yang, Long, Jiaming Ji +13 · 4 citations
Computer Science · #Reinforcement Learning in Robotics #Software Reliability and Analysis Research
- SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset
2024/06/20 by Josef Dai, Dai, Josef, Xuyao Wang +10 · 6 citations
Computer Science · #Advanced Text Analysis Techniques #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #Databases (cs.DB) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling
- PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models
2025/04/22 by Shi Qiu, Shaoyang Guo, Qiu, Shi +98 · 12 citations
Computer Science · #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Online Learning and Analytics #Topic Modeling
- Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback
2024/12/20 by Jiaming Ji, Ji, Jiaming, Jiayi Zhou +34 · 8 citations
Computer Science · #Intelligent Tutoring Systems and Adaptive Learning #Speech and dialogue systems #Natural Language Processing Techniques
- RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?
2025/01/20 by Haotian Xu, Xing Wu, Xu, Haotian +25 · 8 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation
2025/05/30 by Junyu Luo, Luo, Junyu, Zhizhuo Kou +23 · 10 citations
Decision Sciences · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Stock Market Forecasting Methods
- RobustVLA: On Robustness of Vision-Language-Action Model against Multi-Modal Perturbations
2025/09/26 by Jianing Guo, Zhenhong Wu, Guo, Jianing +29 · 4 citations
#cs.CV #cs.AI #cs.RO
- Medical Reasoning in the Era of LLMs: A Systematic Review of Enhancement Techniques and Applications
2025/08/01 by Wenxuan Wang, Zhongjun Ma, Wang, Wenxuan +16 · 3 citations
Medicine · Computer Science · #Artificial Intelligence in Healthcare and Education #Machine Learning in Healthcare #Multimodal Machine Learning Applications
- A Game-Theoretic Negotiation Framework for Cross-Cultural Consensus in LLMs
2025/06/16 by Guoxi Zhang, Zhang, Guoxi, Jiawei Chen +8 · 1 citation
Business, Management and Accounting · #Outsourcing and Supply Chain Management
- Generative RLHF-V: Learning Principles from Multi-modal Human Preference
2025/05/24 by Jiayi Zhou, Jiaming Ji, Zhou, Jiayi +14 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech and dialogue systems