vix.ing · top · new · best · stats · spec

Grinsztajn, Nathan

  1. Should we be going MAD? A Look at Multi-Agent Debate Strategies for LLMs
    2023/11/29 by Andries Smit, Smit, Andries, Paul Duckworth +7 · 25 citations
    Computer Science · Medicine · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Healthcare and Education #Computation and Language (cs.CL) #Expert finding and Q&A systems #FOS: Computer and information sciences #Topic Modeling
  2. Aya Expanse: Combining Research Breakthroughs for a New Multilingual Frontier
    2024/12/05 by John Dang, Shivalika Singh, Dang, John +90 · 2 voices · 29 citations
    Arts and Humanities · Computer Science · #Second Language Learning and Teaching #cs.CL
  3. Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX
    2023/06/16 by Bonnet, Clément, Luo, Daniel, Byrne, Donal +21 · 9 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  4. Winner Takes It All: Training Performant RL Populations for Combinatorial Optimization
    2022/10/07 by Nathan Grinsztajn, Grinsztajn, Nathan, Daniel Furelos-Blanco +4 · 6 citations
    Computer Science · Decision Sciences · Engineering · #Artificial Intelligence (cs.AI) #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Metaheuristic Optimization Algorithms Research #Vehicle Routing Optimization Methods
  5. Combinatorial Optimization with Policy Adaptation using Latent Space Search
    2023/11/13 by Félix Chalumeau, Shikha Surana, Chalumeau, Felix +11 · 6 citations
    Computer Science · Engineering · #Advanced Multi-Objective Optimization Algorithms #Vehicle Routing Optimization Methods #Metaheuristic Optimization Algorithms Research
  6. Command A: An Enterprise-Ready Large Language Model
    2025/04/01 by Team Cohere, Cohere, Team, : +316 · 16 citations
    Business, Management and Accounting · Computer Science · #Business Process Modeling and Analysis #Software System Performance and Reliability #Advanced Software Engineering Methodologies
  7. Contrastive Policy Gradient: Aligning LLMs on sequence-level scores in a supervised-friendly fashion
    2024/06/27 by Yannis Flet-Berliac, Flet-Berliac, Yannis, Nathan Grinsztajn +18 · 6 citations
    Decision Sciences · #Educational Assessment and Improvement
  8. There Is No Turning Back: A Self-Supervised Approach for Reversibility-Aware Reinforcement Learning
    2021/06/08 by Nathan Grinsztajn, Johan Ferret, Grinsztajn, Nathan +6 · 2 citations
    Computer Science · #Reinforcement Learning in Robotics #Explainable Artificial Intelligence (XAI) #Data Stream Mining Techniques
  9. ShiQ: Bringing back Bellman to LLMs
    2025/05/16 by Pierre Clavier, Nathan Grinsztajn, Clavier, Pierre +19 · 2 citations
    Medicine · Computer Science · #Artificial Intelligence in Healthcare and Education #Topic Modeling #Natural Language Processing Techniques