PPaperPicks

Peng Zhao

Nanjing University, National Key Laboratory for Novel Software Technology, Cjina

19 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A simple, optimal and efficient algorithm for online exp-concave optimization
  2. AeroSketch: Near-Optimal Time Matrix Sketch Framework for Persistent, Sliding Window, and Distributed Streams
  3. Gradient-Variation Regret Bounds for Unconstrained Online Learning
  4. Gradient-Variation Online Adaptivity for Accelerated Optimization with Hölder Smoothness
  5. Heavy-Tailed Linear Bandits: Huber Regression with One-Pass Update
  6. Non-stationary Online Learning for Curved Losses: Improved Dynamic Regret via Mixability
  7. Optimistic Online-to-Batch Conversions for Accelerated Convergence and Universality
  8. Provably Efficient Online RLHF with One-Pass Reward Modeling
  9. TreeLoRA: Efficient Continual Learning via Layer-Wise LoRAs Guided by a Hierarchical Gradient-Similarity Tree
  10. A Simple and Optimal Approach for Universal Online Learning with Gradient Variations
  11. Dynamic Regret of Adversarial MDPs with Unknown Transition and Linear Function Approximation
  12. Efficient Non-stationary Online Learning by Wavelets with Applications to Online Distribution Shift Adaptation
  13. Gradient-Variation Online Learning under Generalized Smoothness
  14. Handling Heterogeneous Curvatures in Bandit LQR Control
  15. Improved Algorithm for Adversarial Linear Mixture MDPs with Bandit Feedback and Unknown Transition
  16. Learning with Adaptive Resource Allocation
  17. Near-Optimal Dynamic Regret for Adversarial Linear Mixture MDPs
  18. Provably Efficient Reinforcement Learning with Multinomial Logit Function Approximation
  19. Universal Online Convex Optimization with 1 Projection per Round