Amrit Singh Bedi
- MaxMin-RLHF: Alignment with Diverse Human Preferences
2024/02/14 by Souradip Chakraborty, Jiahao Qiu, Chakraborty, Souradip +13 · 26 citations
Computer Science · #Topic Modeling #Natural Language Processing Techniques #Speech Recognition and Synthesis
- Variational Policy Gradient Method for Reinforcement Learning with General Utilities
2020/07/04 by Junyu Zhang, Zhang, Junyu, Alec Koppel +7 · 9 citations
Computer Science · Engineering · #Adaptive Dynamic Programming Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Traffic control and management
- On the Possibilities of AI-Generated Text Detection
2023/04/10 by Souradip Chakraborty, Chakraborty, Souradip, Amrit Singh Bedi +9 · 11 citations
Computer Science · #Topic Modeling #Natural Language Processing Techniques
- Transfer Q Star: Principled Decoding for LLM Alignment
2024/05/30 by Souradip Chakraborty, Chakraborty, Souradip, Soumya Suvra Ghosal +11 · 1 voice · 8 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mathematics, Computing, and Information Processing #Natural Language Processing Techniques #cs.CL #cs.LG
- Tracking Moving Agents via Inexact Online Gradient Descent Algorithm
2017/10/14 by Amrit Singh Bedi, Bedi, Amrit Singh, P.S. Sarma +3 · 3 citations
Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Distributed Control Multi-Agent Systems #Stochastic Gradient Optimization Techniques
- FedNew: A Communication-Efficient and Privacy-Preserving Newton-Type Method for Federated Learning
2022/06/17 by Anis Elgabli, Chaouki Ben Issaid, Elgabli, Anis +9 · 3 citations
Computer Science · Engineering · #Cryptography and Security (cs.CR) #Distributed #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Parallel #Privacy-Preserving Technologies in Data #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques #and Cluster Computing (cs.DC)
- Does Thinking More always Help? Mirage of Test-Time Scaling in Reasoning Models
2025/06/04 by Soumya Suvra Ghosal, Ghosal, Soumya Suvra, Avinash Reddy +14 · 12 citations
Computer Science · Social Sciences · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Ethics and Social Impacts of AI #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Mobile Crowdsensing and Crowdsourcing
- Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment
2025/01/07 by Prashant Trivedi, Souradip Chakraborty, Trivedi, Prashant +9 · 6 citations
Computer Science · #Artificial Intelligence (cs.AI) #Digital Rights Management and Security #FOS: Computer and information sciences #Machine Learning (cs.LG)
- SAIL: Self-Improving Efficient Online Alignment of Large Language Models
2024/06/21 by Mucong Ding, Souradip Chakraborty, Ding, Mucong +13 · 4 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling
- Beyond Joint Demonstrations: Personalized Expert Guidance for Efficient Multi-Agent Reinforcement Learning
2024/03/13 by Peihong Yu, Yu, Peihong, Manav Mishra +13 · 2 citations
Decision Sciences · #Artificial Intelligence (cs.AI) #Complex Systems and Decision Making #FOS: Computer and information sciences #Multiagent Systems (cs.MA) #Robotics (cs.RO)
- On the Global Convergence of Natural Actor-Critic with Two-layer Neural Network Parametrization
2023/06/18 by Mudit Gaur, Amrit Singh Bedi, Gaur, Mudit +5 · 2 citations
Computer Science · #Adversarial Robustness in Machine Learning #F.2.1 #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural Networks and Reservoir Computing #Reinforcement Learning in Robotics
- FACT or Fiction: Can Truthful Mechanisms Eliminate Federated Free Riding?
2024/05/22 by Marco Bornstein, Amrit Singh Bedi, Bornstein, Marco +5 · 1 voice · 1 citation
Economics, Econometrics and Finance · #Law, Economics, and Judicial Systems #cs.DC #cs.GT #cs.LG #econ.TH
- Towards Global Optimality for Practical Average Reward Reinforcement Learning without Mixing Time Oracles
2024/03/18 by Bhrij Patel, Wesley A. Suttle, Patel, Bhrij +11 · 1 citation
Biochemistry, Genetics and Molecular Biology · Computer Science · Engineering · #Advanced Control Systems Optimization #FOS: Computer and information sciences #Formal Methods in Verification #Gene Regulatory Network Analysis #Machine Learning (cs.LG)
- On the Role of Feedback in Test-Time Scaling of Agentic AI Workflows
2025/04/02 by Chakraborty, Souradip, Mohammadreza Pourreza, Pourreza, Mohammadreza +16 · 2 citations
Decision Sciences · Computer Science · #Scientific Computing and Data Management #Explainable Artificial Intelligence (XAI) #Multi-Agent Systems and Negotiation
- Training Fast Robot Policies with Slow Foundation Models
2024/06/09 by Utsav Singh, Pramit Bhattacharyya, Singh, Utsav +4 · 1 citation
#cs.LG #cs.CL #cs.RO
- Online Learning With Inexact Proximal Online Gradient Descent Algorithms
2019/01/01 by Rishabh Dixit, Amrit Singh Bedi, Ruchi Tripathi +1 · 1 citation
Engineering · Decision Sciences · Computer Science · #Sparse and Compressive Sensing Techniques #Advanced Bandit Algorithms Research #Distributed Control Multi-Agent Systems
- Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time
2025/05/29 by Mohamad Chehade, Chehade, Mohamad, Soumya Suvra Ghosal +11 · 2 citations
Computer Science · Social Sciences · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Law #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques