Tao, Jian
- Using Human Feedback to Fine-tune Diffusion Models without Any Reward Model
2023/11/22 by Kai Yang, Jian Tao, Yang, Kai +15 · 73 citations
Computer Science · Neuroscience · #Stochastic Gradient Optimization Techniques #Brain Tumor Detection and Classification #Machine Learning and ELM
- Exploration and Anti-Exploration with Distributional Random Network Distillation
2024/01/18 by Kai Yang, Jian Tao, Yang, Kai +5 · 14 citations
Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
- World Models with Hints of Large Language Models for Goal Achieving
2024/06/11 by Liu, Zeyuan, Huan, Ziyu, Wang, Xiyao +5 · 2 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Multi-agent Exploration with Sub-state Entropy Estimation
2023/06/10 by Tao, Jian, Zhang, Yang, Chen, Yangkun +1 · 1 citation
#FOS: Computer and information sciences #Multiagent Systems (cs.MA)
- AutoFLUKA: A Large Language Model Based Framework for Automating Monte Carlo Simulations in FLUKA
2024/10/19 by Zavier Ndum Ndum, Ndum, Zavier Ndum, John Ford +3 · 1 citation
Decision Sciences · #Simulation Techniques and Applications
- Novelty-Guided Data Reuse for Efficient and Diversified Multi-Agent Reinforcement Learning
2024/12/20 by Yangkun Chen, Kai Yang, Chen, Yangkun +5 · 2 citations
Computer Science · #Reinforcement Learning in Robotics