Bruno Castro da Silva
- RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs
2024/04/12 by Shreyas Chaudhari, Chaudhari, Shreyas, Pranjal Aggarwal +13 · 28 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Topic Modeling
- On Ensuring that Intelligent Machines Are Well-Behaved
2017/08/17 by Philip S. Thomas, Thomas, Philip S., Bruno Castro da Silva +5 · 2 citations
Computer Science · #Explainable Artificial Intelligence (XAI) #Machine Learning and Data Classification #Reinforcement Learning in Robotics #cs.AI
- Position: Benchmarking is Limited in Reinforcement Learning Research
2024/06/23 by Scott M. Jordan, Jordan, Scott M., Adam White +7 · 3 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Methodology (stat.ME) #Open Source Software Innovations
- Universal Off-Policy Evaluation
2021/04/26 by Yash Chandak, Scott Niekum, Chandak, Yash +9 · 2 citations
Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #Risk and Portfolio Optimization #Statistical Methods and Inference #cs.LG