P
PaperPicks
Conferences
Yujing Hu
15 papers at tracked venues · 9 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
ICLR
×3
AAMAS
×2
IJCAI
×2
NeurIPS
×2
AAAI
×1
ECCV
×1
ICML
×1
SIGKDD
×1
UAI
×1
WWW
×1
Frequent coauthors
Yiwen Zhu
DBLP profile ↗
ORCID search ↗
×3
Jiashun Liu
DBLP profile ↗
ORCID search ↗
×2
Chao Li
DBLP profile ↗
ORCID search ↗
×2
Zhaohui Jiang
DBLP profile ↗
ORCID search ↗
×1
Jinyi Liu
DBLP profile ↗
ORCID search ↗
×1
Zibin Dong
DBLP profile ↗
ORCID search ↗
×1
Hao Hu
DBLP profile ↗
ORCID search ↗
×1
Hanwei Liu
DBLP profile ↗
ORCID search ↗
×1
Yihuan Mao
DBLP profile ↗
ORCID search ↗
×1
Shiwei Zhao
DBLP profile ↗
ORCID search ↗
×1
Yu Xiong
DBLP profile ↗
ORCID search ↗
×1
Papers
Improving Reward Models with Proximal Policy Exploration for Preference-Based Reinforcement Learning
NeurIPS 2025
·
Yiwen Zhu
DBLP profile ↗
ORCID search ↗
Reinforcement Learning from Imperfect Corrective Actions and Proxy Rewards
ICLR 2025
·
Zhaohui Jiang
DBLP profile ↗
ORCID search ↗
A Trajectory Perspective on the Role of Data Sampling Techniques in Offline Reinforcement Learning
AAMAS 2024
·
Jinyi Liu
DBLP profile ↗
ORCID search ↗
AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model
ICLR 2024
·
Zibin Dong
DBLP profile ↗
ORCID search ↗
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
ICML 2024
·
Hao Hu
DBLP profile ↗
ORCID search ↗
Hybrid CtrlFormer: Learning Adaptive Search Space Partition for Hybrid Action Control via Transformer-based Monte Carlo Tree Search
UAI 2024
·
Jiashun Liu
DBLP profile ↗
ORCID search ↗
Norface: Improving Facial Expression Analysis by Identity Normalization
ECCV 2024
·
Hanwei Liu
DBLP profile ↗
ORCID search ↗
Optimistic Value Instructors for Cooperative Multi-Agent Reinforcement Learning
AAAI 2024
·
Chao Li
DBLP profile ↗
ORCID search ↗
STAR: Spatio-Temporal State Compression for Multi-Agent Tasks with Rich Observations
IJCAI 2024
·
Chao Li
DBLP profile ↗
ORCID search ↗
Stylized Offline Reinforcement Learning: Extracting Diverse High-Quality Behaviors from Heterogeneous Datasets
ICLR 2024
·
Yihuan Mao
DBLP profile ↗
ORCID search ↗
The MMO Economist: AI Empowers Robust, Healthy, and Sustainable P2W MMO Economies
WWW 2024
·
Shiwei Zhao
DBLP profile ↗
ORCID search ↗
Unlock the Intermittent Control Ability of Model Free Reinforcement Learning
NeurIPS 2024
·
Jiashun Liu
DBLP profile ↗
ORCID search ↗
XRL-Bench: A Benchmark for Evaluating and Comparing Explainable Reinforcement Learning Techniques
SIGKDD 2024
·
Yu Xiong
DBLP profile ↗
ORCID search ↗
vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
IJCAI 2024
·
Yiwen Zhu
DBLP profile ↗
ORCID search ↗
vMFER: von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement of Actor-Critic Algorithms
AAMAS 2024
·
Yiwen Zhu
DBLP profile ↗
ORCID search ↗