vix.ing · top · new · best · stats · spec

Joshi, Rishabh

  1. Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context
    2024/03/08 by Gemini Robotics Team, Gemini Team, Petko Georgiev +2277 · 4 voices · 1009 citations
    Computer Science · #Semantic Web and Ontologies
  2. Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
    2025/07/07 by Gheorghe Comanici, Comanici, Gheorghe, Eric Bieber +6844 · 8 voices · 1398 citations
    #cs.CL #cs.AI
  3. SLiC-HF: Sequence Likelihood Calibration with Human Feedback
    2023/05/17 by Yao Zhao, Zhao, Yao, Rishabh Joshi +9 · 1 voice · 68 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling #cs.AI #cs.CL
  4. Gemini: A Family of Highly Capable Multimodal Models
    2023/12/19 by Gemini Robotics Team, Gemini Team, Rohan Anil +2692 · 9 voices · 8 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #cs.AI #cs.CL #cs.CV
  5. Statistical Rejection Sampling Improves Preference Optimization
    2023/09/13 by Tianqi Liu, Liu, Tianqi, Yao Zhao +11 · 66 citations
    Computer Science · #Topic Modeling #Speech and dialogue systems #Natural Language Processing Techniques
  6. LiPO: Listwise Preference Optimization through Learning-to-Rank
    2024/02/02 by Tianqi Liu, Zhen Qin, Liu, Tianqi +21 · 23 citations
    Computer Science · #Computation and Language (cs.CL) #Data Management and Algorithms #FOS: Computer and information sciences #Machine Learning (cs.LG)
  7. Calibrating Sequence likelihood Improves Conditional Language Generation
    2022/09/30 by Yao Zhao, Misha Khalman, Zhao, Yao +9 · 14 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Multimodal Machine Learning Applications
  8. RRM: Robust Reward Model Training Mitigates Reward Hacking
    2024/09/20 by Tianqi Liu, Wei Xiong, Liu, Tianqi +33 · 28 citations
    Psychology · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Human-Automation Interaction and Safety
  9. Human Alignment of Large Language Models through Online Preference Optimisation
    2024/03/13 by Daniele Calandriello, Daniel Guo, Calandriello, Daniele +23 · 15 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling
  10. Building Math Agents with Multi-Turn Iterative Preference Learning
    2024/09/04 by Wei Xiong, Chengshuai Shi, Xiong, Wei +23 · 18 citations
    Computer Science · #Educational Technology and Assessment #FOS: Computer and information sciences #Fuzzy Logic and Control Systems #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Rough Sets and Fuzzy Logic
  11. Offline Regularised Reinforcement Learning for Large Language Models Alignment
    2024/05/29 by Pierre Harvey Richemond, Yunhao Tang, Richemond, Pierre Harvey +33 · 15 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Speech Recognition and Synthesis #Topic Modeling
  12. Scalable Reinforcement Post-Training Beyond Static Human Prompts: Evolving Alignment via Asymmetric Self-Play
    2024/10/31 by Ziyu Ye, Ye, Ziyu, Agarwal, Rishabh +11 · 10 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Data Analysis #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #FOS: Physical sciences #Machine Learning (stat.ML) #Modular Robots and Swarm Intelligence #Reinforcement Learning in Robotics #Statistics and Probability (physics.data-an)
  13. Learning from negative feedback, or positive feedback or both
    2024/10/05 by Abbas Abdolmaleki, Abdolmaleki, Abbas, Bilal Piot +21 · 6 citations
    Computer Science · #Semantic Web and Ontologies
  14. DialoGraph: Incorporating Interpretable Strategy-Graph Networks into Negotiation Dialogues
    2021/06/02 by Rishabh Joshi, Joshi, Rishabh, Vidhisha Balachandran +7 · 2 citations
    Computer Science · #Advanced Graph Neural Networks #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Topic Modeling
  15. Keeping Up Appearances: Computational Modeling of Face Acts in Persuasion Oriented Discussions
    2020/09/22 by Dutt, Ritam, Joshi, Rishabh, Rose, Carolyn Penstein · 1 citation
    #Computation and Language (cs.CL) #FOS: Computer and information sciences
  16. RESPER: Computationally Modelling Resisting Strategies in Persuasive\n Conversations
    2021/01/25 by Ritam Dutt, Dutt, Ritam, Sayan Sinha +13 · 1 citation
    Computer Science · Social Sciences · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Digital Communication and Language #FOS: Computer and information sciences #Misinformation and Its Impacts #Social and Intergroup Psychology
  17. LTIatCMU at SemEval-2020 Task 11: Incorporating Multi-Level Features for Multi-Granular Propaganda Span Identification
    2020/08/11 by Khosla, Sopan, Joshi, Rishabh, Dutt, Ritam +2 · 1 citation
    #Computation and Language (cs.CL) #FOS: Computer and information sciences #Information Retrieval (cs.IR) #Machine Learning (cs.LG)