PPaperPicks

Washim Uddin Mondal

9 papers at tracked venues · 6 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. A Sharper Global Convergence Analysis for Average Reward Reinforcement Learning via an Actor-Critic Approach
  2. Finite-Sample Analysis of Policy Evaluation for Robust Average Reward Reinforcement Learning
  3. Global Convergence for Average Reward Constrained MDPs with Primal-Dual Actor Critic Algorithm
  4. Order-Optimal Global Convergence for Actor-Critic with General Policy and Neural Critic Parametrization
  5. Order-Optimal Regret with Novel Policy Gradient Approaches in Infinite-Horizon Average Reward MDPs
  6. Improved Sample Complexity Analysis of Natural Policy Gradient Algorithm with General Parameterization for Infinite Horizon Discounted Reward Markov Decision Processes
    AISTATS 2024 · Washim Uddin Mondal
  7. Learning General Parameterized Policies for Infinite Horizon Average Reward Constrained MDPs via Primal-Dual Policy Gradient Algorithm
  8. Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision Processes
  9. Sample-Efficient Constrained Reinforcement Learning with General Parameterization
    NeurIPS 2024 · Washim Uddin Mondal