Rishabh Joshi
- Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context
2024/03/08 by Gemini Robotics Team, Gemini Team, Petko Georgiev +2277 · 4 voices · 730 citations
Computer Science · #Semantic Web and Ontologies
- Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
2025/07/07 by Gheorghe Comanici, Comanici, Gheorghe, Eric Bieber +6844 · 8 voices · 1393 citations
#cs.CL #cs.AI
- SLiC-HF: Sequence Likelihood Calibration with Human Feedback
2023/05/17 by Yao Zhao, Rishabh Joshi, Zhao, Yao +9 · 1 voice · 45 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling #cs.AI #cs.CL
- Gemini: A Family of Highly Capable Multimodal Models
2023/12/19 by Gemini Robotics Team, Rohan Anil, Gemini Team +2692 · 9 voices · 7 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #cs.AI #cs.CL #cs.CV
- Statistical Rejection Sampling Improves Preference Optimization
2023/09/13 by Tianqi Liu, Liu, Tianqi, Yao Zhao +11 · 38 citations
Computer Science · #Topic Modeling #Speech and dialogue systems #Natural Language Processing Techniques
- LiPO: Listwise Preference Optimization through Learning-to-Rank
2024/02/02 by Tianqi Liu, Zhen Qin, Liu, Tianqi +21 · 15 citations
Computer Science · #Computation and Language (cs.CL) #Data Management and Algorithms #FOS: Computer and information sciences #Machine Learning (cs.LG)
- RRM: Robust Reward Model Training Mitigates Reward Hacking
2024/09/20 by Tianqi Liu, Wei Xiong, Liu, Tianqi +33 · 21 citations
Psychology · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Human-Automation Interaction and Safety
- Calibrating Sequence likelihood Improves Conditional Language Generation
2022/09/30 by Yao Zhao, Zhao, Yao, Misha Khalman +9 · 8 citations
Computer Science · #Topic Modeling #Natural Language Processing Techniques #Multimodal Machine Learning Applications
- Building Math Agents with Multi-Turn Iterative Preference Learning
2024/09/04 by Wei Xiong, Xiong, Wei, Chengshuai Shi +23 · 12 citations
Computer Science · #Educational Technology and Assessment #FOS: Computer and information sciences #Fuzzy Logic and Control Systems #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Rough Sets and Fuzzy Logic
- Offline Regularised Reinforcement Learning for Large Language Models Alignment
2024/05/29 by Pierre Harvey Richemond, Richemond, Pierre Harvey, Yunhao Tang +33 · 8 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Speech Recognition and Synthesis #Topic Modeling
- Learning from negative feedback, or positive feedback or both
2024/10/05 by Abbas Abdolmaleki, Abdolmaleki, Abbas, Bilal Piot +21 · 5 citations
Computer Science · #Semantic Web and Ontologies