Wang, Yawei
- A Systematic Survey of Automatic Prompt Optimization Techniques
2025/02/24 by Ramnath, Kiran, Zhou, Kang, Guan, Sheng +18 · 19 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences
- Reinforcement Learning for Self-Improving Agent with Skill Library
2025/12/18 by Jiongxiao Wang, Wang, Jiongxiao, Qiaojing Yan +15 · 5 citations
Computer Science · #Reinforcement Learning in Robotics #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning
- SALT: Step-level Advantage Assignment for Long-horizon Agents via Trajectory Graph
2025/10/22 by Li, Jiazheng, Wang, Yawei, Yan, David +5 · 2 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- Breaking the Safety-Capability Tradeoff: Reinforcement Learning with Verifiable Rewards Maintains Safety Guardrails in LLMs
2025/11/26 by Dongkyu Derek Cho, Cho, Dongkyu Derek, Huan Song +15 · 1 citation
Computer Science · Social Sciences · #Adversarial Robustness in Machine Learning #Ethics and Social Impacts of AI #Explainable Artificial Intelligence (XAI)