P
PaperPicks
Conferences
Qinbo Bai
3 papers at tracked venues · 3 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
NeurIPS
×2
AAAI
×1
Frequent coauthors
Yang Xu
DBLP profile ↗
ORCID search ↗
×1
Papers
Global Convergence for Average Reward Constrained MDPs with Primal-Dual Actor Critic Algorithm
NeurIPS 2025
·
Yang Xu
DBLP profile ↗
ORCID search ↗
Learning General Parameterized Policies for Infinite Horizon Average Reward Constrained MDPs via Primal-Dual Policy Gradient Algorithm
NeurIPS 2024
·
Qinbo Bai
Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision Processes
AAAI 2024
·
Qinbo Bai