John D. Co-Reyes
- Training Language Models to Self-Correct via Reinforcement Learning
2024/09/19 by Aviral Kumar, Vincent Zhuang, Kumar, Aviral +36 · 2 voices · 76 citations
Computer Science · #Speech and dialogue systems #Topic Modeling #Natural Language Processing Techniques
- Many-Shot In-Context Learning
2024/04/17 by Rishabh Agarwal, Agarwal, Rishabh, Avi Singh +27 · 1 voice · 48 citations
#cs.LG #cs.AI #cs.CL
- Evolving Reinforcement Learning Algorithms
2021/01/08 by John D. Co-Reyes, Co-Reyes, John D., Yingjie Miao +13 · 3 voices · 1 citation
#cs.LG #cs.AI #cs.NE
- Beyond Human Data: Scaling Self-Training for Problem-Solving with Language Models
2023/12/11 by Avi Singh, John D. Co-Reyes, Singh, Avi +76 · 35 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Natural Language Processing Techniques #Topic Modeling
- Small-scale proxies for large-scale Transformer training instabilities
2023/09/25 by Mitchell Wortsman, Wortsman, Mitchell, Peter J. Liu +29 · 26 citations
Computer Science · Decision Sciences · #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Forecasting Techniques and Applications #Gaussian Processes and Bayesian Inference #Machine Learning (cs.LG)
- Waymax: An Accelerated, Data-Driven Simulator for Large-Scale Autonomous Driving Research
2023/10/12 by Cole Gulino, Justin Fu, Gulino, Cole +41 · 22 citations
Engineering · Psychology · #Autonomous Vehicle Technology and Safety #Traffic control and management #Human-Automation Interaction and Safety
- EX2: Exploration with Exemplar Models for Deep Reinforcement Learning
2017/03/03 by Justin Fu, Fu, Justin, John D. Co-Reyes +3 · 7 citations
Computer Science · Decision Sciences · Engineering · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Smart Grid Energy Management
- Improving Large Language Model Fine-tuning for Solving Math Problems
2023/10/16 by Yixin Liu, Avi Singh, Liu, Yixin +7 · 7 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Text Readability and Simplification #Topic Modeling
- Self-Consistent Trajectory Autoencoder: Hierarchical Reinforcement Learning with Trajectory Embeddings
2018/06/07 by John D. Co-Reyes, Co-Reyes, John D., YuXuan Liu +9 · 3 citations
Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics