Anirudh Satheesh
- Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities
2025/02/03 by Zora Che, Stephen Casper, Che, Zora +27 · 10 citations
Computer Science · #Security and Verification in Computing #Advanced Malware Detection Techniques #Network Security and Intrusion Detection
- EnsemW2S: Enhancing Weak-to-Strong Generalization with Large Language Model Ensembles
2024/10/06 by Aakriti Agrawal, Agrawal, Aakriti, Mucong Ding +11 · 4 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques
- DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning
2026/07/17 by Hanyang Chen, Anirudh Satheesh, Longchao Da +1
#cs.LG #cs.AI