Piotr Januszewski
- Continuous Control With Ensemble Deep Deterministic Policy Gradients
2021/11/30 by Piotr Januszewski, Januszewski, Piotr, Mateusz Olko +11 · 1 citation
Computer Science · Physics and Astronomy · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Model Reduction and Neural Networks #Reinforcement Learning in Robotics
- Nemotron 3 Nano: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning
2025/12/23 by NVIDIA, Aaron Blakeman, : +623 · 1 voice · 2 citations
#cs.CL #cs.AI #cs.LG