Ammar N. Abbas
- BASE TTS: Lessons from building a billion-parameter Text-to-Speech model on 100K hours of data
2024/02/12 by Mateusz Łajszczak, Guillermo Cámbara, Łajszczak, Mateusz +36 · 2 voices · 29 citations
Computer Science · Engineering · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Natural Language Processing Techniques #Speech Recognition and Synthesis #Topic Modeling #cs.CL #cs.LG #eess.AS #electronic engineering #information engineering
- Prosodic Representation Learning and Contextual Sampling for Neural\n Text-to-Speech
2020/11/04 by Sri Karlapati, Ammar N. Abbas, Karlapati, Sri +11 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Natural Language Processing Techniques #Sound (cs.SD) #Speech Recognition and Synthesis #Topic Modeling #electronic engineering #information engineering
- Expressive, Variable, and Controllable Duration Modelling in TTS
2022/06/28 by Ammar N. Abbas, Abbas, Ammar, Thomas Merritt +13 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Natural Language Processing Techniques #Sound (cs.SD) #Speech Recognition and Synthesis #Topic Modeling #electronic engineering #information engineering
- Safety-Driven Deep Reinforcement Learning Framework for Cobots: A Sim2Real Approach
2024/07/02 by Ammar N. Abbas, Shakra Mehak, Abbas, Ammar N. +11 · 1 citation
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robotics (cs.RO)