Ramasubramanian, Bhaskar
- ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs
2024/02/19 by Fengqing Jiang, Zhangchen Xu, Jiang, Fengqing +11 · 11 voices · 79 citations
Computer Science · #Digital and Cyber Forensics #Digital Rights Management and Security #Law, AI, and Intellectual Property
- BadChain: Backdoor Chain-of-Thought Prompting for Large Language Models
2024/01/20 by Zhen Xiang, Fengqing Jiang, Xiang, Zhen +9 · 29 citations
Computer Science · Medicine · #Adversarial Robustness in Machine Learning #Artificial Intelligence in Healthcare and Education #Cryptography and Security (cs.CR) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Topic Modeling
- Small Models Struggle to Learn from Strong Reasoners
2025/02/17 by Yuetai Li, Li, Yuetai, Yue Xiang +13 · 47 citations
Decision Sciences · Mathematics · Engineering · #Complex Systems and Decision Making #Statistics Education and Methodologies #Reservoir Engineering and Simulation Methods
- CleanGen: Mitigating Backdoor Attacks for Generation Tasks in Large Language Models
2024/06/18 by Li, Yuetai, Xu, Zhangchen, Jiang, Fengqing +4 · 6 citations
#Artificial Intelligence (cs.AI) #Cryptography and Security (cs.CR) #FOS: Computer and information sciences
- Agent-Temporal Attention for Reward Redistribution in Episodic Multi-Agent Reinforcement Learning
2022/01/12 by Baicen Xiao, Bhaskar Ramasubramanian, Xiao, Baicen +3 · 2 citations
Computer Science · Neuroscience · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Neural and Behavioral Psychology Studies #Reinforcement Learning in Robotics
- TinyV: Reducing False Negatives in Verification Improves RL for LLM Reasoning
2025/05/20 by Zhangchen Xu, Xu, Zhangchen, Yuetai Li +11 · 7 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Topic Modeling
- MDTD: A Multi Domain Trojan Detector for Deep Neural Networks
2023/08/30 by Arezoo Rajabi, Surudhi Asokraj, Rajabi, Arezoo +11 · 2 citations
Computer Science · #Adversarial Robustness in Machine Learning
- FRESH: Interactive Reward Shaping in High-Dimensional State Spaces using Human Feedback
2020/01/19 by Baicen Xiao, Qifan Lu, Xiao, Baicen +9 · 1 citation
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Reinforcement Learning in Robotics
- Temporal Sampling for Forgotten Reasoning in LLMs
2025/05/26 by Li, Yuetai, Xu, Zhangchen, Jiang, Fengqing +5 · 7 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Reinforcement Learning Beyond Expectation
2021/03/29 by Ramasubramanian, Bhaskar, Niu, Luyao, Clark, Andrew +1 · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC) #Systems and Control (eess.SY) #electronic engineering #information engineering
- VisualSphinx: Large-Scale Synthetic Vision Logic Puzzles for RL
2025/05/29 by Feng, Yichen, Xu, Zhangchen, Jiang, Fengqing +5 · 6 citations
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- SoSBench: Benchmarking Safety Alignment on Six Scientific Domains
2025/05/27 by Fengqing Jiang, Feiyue Ma, Jiang, Fengqing +14 · 2 citations
Health Professions · Decision Sciences · Engineering · #Occupational Health and Safety Research #Risk and Safety Analysis #Safety Systems Engineering in Autonomy