P
PaperPicks
Conferences
Qining Zhang
2 papers at tracked venues · 2 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×1
ICLR
×1
Frequent coauthors
Yifan Wang
DBLP profile ↗
ORCID search ↗
×1
Papers
Zeroth-Order Policy Gradient for Reinforcement Learning from Human Feedback without Reward Inference
ICLR 2025
·
Qining Zhang
Deep Reinforcement Learning for Early Diagnosis of Lung Cancer
AAAI 2024
·
Yifan Wang
DBLP profile ↗
ORCID search ↗