PPaperPicks

Yujing Hu

15 papers at tracked venues · 9 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Improving Reward Models with Proximal Policy Exploration for Preference-Based Reinforcement Learning
  2. Reinforcement Learning from Imperfect Corrective Actions and Proxy Rewards
  3. A Trajectory Perspective on the Role of Data Sampling Techniques in Offline Reinforcement Learning
  4. AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model
  5. Bayesian Design Principles for Offline-to-Online Reinforcement Learning
  6. Hybrid CtrlFormer: Learning Adaptive Search Space Partition for Hybrid Action Control via Transformer-based Monte Carlo Tree Search
  7. Norface: Improving Facial Expression Analysis by Identity Normalization
  8. Optimistic Value Instructors for Cooperative Multi-Agent Reinforcement Learning
  9. STAR: Spatio-Temporal State Compression for Multi-Agent Tasks with Rich Observations
  10. Stylized Offline Reinforcement Learning: Extracting Diverse High-Quality Behaviors from Heterogeneous Datasets
  11. The MMO Economist: AI Empowers Robust, Healthy, and Sustainable P2W MMO Economies
  12. Unlock the Intermittent Control Ability of Model Free Reinforcement Learning
  13. XRL-Bench: A Benchmark for Evaluating and Comparing Explainable Reinforcement Learning Techniques
  14. vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
  15. vMFER: von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement of Actor-Critic Algorithms