Jungwook Choi
- Training Deep Neural Networks with 8-bit Floating Point Numbers
2018/12/19 by Naigang Wang, Jungwook Choi, Wang, Naigang +7 · 39 citations
Computer Science · Physics and Astronomy · #Advanced Neural Network Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Neural Networks and Applications
- NN-LUT: Neural Approximation of Non-Linear Operations for Efficient Transformer Inference
2021/12/03 by Joonsang Yu, Yu, Joonsang, Junki Park +11 · 9 citations
Computer Science · Materials Science · #Advanced Neural Network Applications #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Magnetic Properties and Applications #Neural Networks and Applications
- InfiniPot: Infinite Context Processing on Memory-Constrained LLMs
2024/10/02 by Min‐Soo Kim, Kyuhong Shim, Kim, Minsoo +5 · 10 citations
Computer Science · #Natural Language Processing Techniques #Semantic Web and Ontologies #Topic Modeling
- Token-Scaled Logit Distillation for Ternary Weight Generative Language Models
2023/08/13 by Minsoo Kim, Si-Hwa Lee, Kim, Minsoo +11 · 4 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling
- Quantization-Aware Imitation-Learning for Resource-Efficient Robotic Control
2024/12/02 by Seongmin Park, Park, Seongmin, Hyungmin Kim +11 · 8 citations
Computer Science · Engineering · #Advanced Vision and Imaging #CCD and CMOS Imaging Sensors #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
- Understanding and Improving Knowledge Distillation for Quantization-Aware Training of Large Transformer Encoders
2022/11/20 by Minsoo Kim, Kim, Minsoo, Si-Hwa Lee +7 · 2 citations
Computer Science · Physics and Astronomy · #Advanced Neural Network Applications #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Model Reduction and Neural Networks #Neural Networks and Applications
- Improving Conversational Abilities of Quantized Large Language Models via Direct Preference Alignment
2024/07/03 by Janghwan Lee, Seongmin Park, Lee, Janghwan +9 · 3 citations
Computer Science · #Natural Language Processing Techniques #Topic Modeling #Speech and dialogue systems
- InfiniPot-V: Memory-Constrained KV Cache Compression for Streaming Video Understanding
2025/06/18 by Min‐Soo Kim, Kyuhong Shim, Kim, Minsoo +4 · 7 citations
Computer Science · #Multimodal Machine Learning Applications #Video Analysis and Summarization #Human Pose and Action Recognition
- RILQ: Rank-Insensitive LoRA-based Quantization Error Compensation for Boosting 2-bit Large Language Model Accuracy
2024/12/02 by Geonho Lee, Janghwan Lee, Lee, Geonho +11 · 1 voice · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.AI #cs.LG
- Layer-wise Pruning of Transformer Attention Heads for Efficient Language\n Modeling
2021/10/07 by Kyuhong Shim, Shim, Kyuhong, Iksoo Choi +5 · 1 citation
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech Recognition and Synthesis #Topic Modeling
- SPADE: Sparse Pillar-based 3D Object Detection Accelerator for Autonomous Driving
2023/05/12 by Minjae Lee, Lee, Minjae, Seongmin Park +14 · 1 citation
Computer Science · Engineering · #Advanced Neural Network Applications #Robotics and Sensor-Based Localization #Visual Attention and Saliency Detection
- PIMphony: Overcoming Bandwidth and Capacity Inefficiency in PIM-based Long-Context LLM Inference System
2024/12/28 by Kwon, Hyucksung, Kyungmo Koo, Koo, Kyungmo +39 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Hardware Architecture (cs.AR) #semigroups and automata theory
- Tangram: Unlocking Non-Uniform KV Cache Compression for Efficient Multi-turn LLM Serving
2026/06/04 by Hyungmin Kim, Minsoo Kim, Hongseok Kim +1 · 1 voice
Computer Science · #cs.LG #cs.SE
- Rethinking Inference-Time Scaling in Local Computer-Use Agents: Failure Modes and Compute Tradeoffs
2026/07/30 by Woongkyu Lee, Jungwook Choi
Computer Science · #cs.AI