Wang, Guoteng
- InternLM2 Technical Report
2024/03/26 by Zheng Cai, Maosong Cao, Cai, Zheng +199 · 2 voices · 94 citations
Medicine · Computer Science · #Artificial Intelligence in Healthcare and Education #Topic Modeling #Machine Learning in Healthcare
- Characterization of Large Language Model Development in the Datacenter
2024/03/12 by Qinghao Hu, Hu, Qinghao, Zhisheng Ye +20 · 24 citations
Computer Science · Decision Sciences · #Distributed and Parallel Computing Systems #Topic Modeling #Scientific Computing and Data Management
- Efficient Training of Large Language Models on Distributed Infrastructures: A Survey
2024/07/29 by Duan, Jiangfei, Zhang, Shuo, Wang, Zerui +13 · 13 citations
#Distributed #FOS: Computer and information sciences #Parallel #and Cluster Computing (cs.DC)
- LoongTrain: Efficient Training of Long-Sequence LLMs with Head-Context Parallelism
2024/06/26 by Diandian Gu, Gu, Diandian, Peng Sun +25 · 8 citations
Computer Science · #Natural Language Processing Techniques #Handwritten Text Recognition Techniques #Speech Recognition and Synthesis
- BAPO: Stabilizing Off-Policy Reinforcement Learning for LLMs via Balanced Policy Optimization with Adaptive Clipping
2025/10/21 by Xi, Zhiheng, Guo, Xin, Nan, Yang +18 · 5 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- InternEvo: Efficient Long-sequence Large Language Model Training via Hybrid Parallelism and Redundant Sharding
2024/01/17 by Qiaoling Chen, Diandian Gu, Chen, Qiaoling +19 · 1 citation
Computer Science · #Distributed #FOS: Computer and information sciences #Natural Language Processing Techniques #Parallel #Speech Recognition and Synthesis #Topic Modeling #and Cluster Computing (cs.DC)
- Expert-as-a-Service: Towards Efficient, Scalable, and Robust Large-scale MoE Serving
2025/09/22 by Ziming Liu, Boyu Tian, Liu, Ziming +33 · 3 citations
Computer Science · Social Sciences · #Context-Aware Activity Recognition Systems #IoT and Edge/Fog Computing #Access Control and Trust