PPaperPicks

Baoxiang Wang

Chinese University of Hong Kong, Department of Computer Science and Engineering, Shenzhen, China

21 papers at tracked venues · 16 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. A Comprehensive Framework for Analyzing the Convergence of Adam: Bridging the Gap with SGD
  2. ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
  3. Improved Approximation Algorithms for k-Submodular Maximization via Multilinear Extension
  4. Last-iterate Convergence in Regularized Graphon Mean Field Game
  5. Learning Imperfect Information Extensive-form Games with Last-iterate Convergence under Bandit Feedback
  6. Learning to Communicate Through Implicit Communication Channels
  7. Learning to Negotiate via Voluntary Commitment
  8. Logarithmic Regret for Linear Markov Decision Processes with Adversarial Corruptions
  9. Multi-Agent Credit Assignment with Pretrained Language Models
  10. Reward Translation via Reward Machine in Semi-Alignable MDPs
  11. Scalable Exploration via Ensemble++
  12. Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
  13. The adaptive complexity of parallelized log-concave sampling
  14. Uncoupled and Convergent Learning in Monotone Games under Bandit Feedback
  15. Carbon Market Simulation with Adaptive Mechanism Design
  16. Convergence to Nash Equilibrium and No-regret Guarantee in (Markov) Potential Games
  17. Few-Shot Diffusion Models Escape the Curse of Dimensionality
  18. On Stationary Point Convergence of PPO-Clip
  19. Online Control with Adversarial Disturbance for Continuous-time Linear Systems
  20. Online Policy Optimization for Robust Markov Decision Process
  21. Relative Policy-Transition Optimization for Fast Policy Transfer