Grinsztajn, Nathan
- Should we be going MAD? A Look at Multi-Agent Debate Strategies for LLMs
2023/11/29 by Andries Smit, Smit, Andries, Paul Duckworth +7 · 25 citations
Computer Science · Medicine · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Healthcare and Education #Computation and Language (cs.CL) #Expert finding and Q&A systems #FOS: Computer and information sciences #Topic Modeling
- Aya Expanse: Combining Research Breakthroughs for a New Multilingual Frontier
2024/12/05 by John Dang, Shivalika Singh, Dang, John +90 · 2 voices · 29 citations
Arts and Humanities · Computer Science · #Second Language Learning and Teaching #cs.CL
- Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX
2023/06/16 by Bonnet, Clément, Luo, Daniel, Byrne, Donal +21 · 9 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Winner Takes It All: Training Performant RL Populations for Combinatorial Optimization
2022/10/07 by Nathan Grinsztajn, Grinsztajn, Nathan, Daniel Furelos-Blanco +4 · 6 citations
Computer Science · Decision Sciences · Engineering · #Artificial Intelligence (cs.AI) #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Metaheuristic Optimization Algorithms Research #Vehicle Routing Optimization Methods
- Combinatorial Optimization with Policy Adaptation using Latent Space Search
2023/11/13 by Félix Chalumeau, Shikha Surana, Chalumeau, Felix +11 · 6 citations
Computer Science · Engineering · #Advanced Multi-Objective Optimization Algorithms #Vehicle Routing Optimization Methods #Metaheuristic Optimization Algorithms Research
- Command A: An Enterprise-Ready Large Language Model
2025/04/01 by Team Cohere, Cohere, Team, : +316 · 16 citations
Business, Management and Accounting · Computer Science · #Business Process Modeling and Analysis #Software System Performance and Reliability #Advanced Software Engineering Methodologies
- Contrastive Policy Gradient: Aligning LLMs on sequence-level scores in a supervised-friendly fashion
2024/06/27 by Yannis Flet-Berliac, Flet-Berliac, Yannis, Nathan Grinsztajn +18 · 6 citations
Decision Sciences · #Educational Assessment and Improvement
- There Is No Turning Back: A Self-Supervised Approach for Reversibility-Aware Reinforcement Learning
2021/06/08 by Nathan Grinsztajn, Johan Ferret, Grinsztajn, Nathan +6 · 2 citations
Computer Science · #Reinforcement Learning in Robotics #Explainable Artificial Intelligence (XAI) #Data Stream Mining Techniques
- ShiQ: Bringing back Bellman to LLMs
2025/05/16 by Pierre Clavier, Nathan Grinsztajn, Clavier, Pierre +19 · 2 citations
Medicine · Computer Science · #Artificial Intelligence in Healthcare and Education #Topic Modeling #Natural Language Processing Techniques