P
PaperPicks
Conferences
Shangtong Zhang
11 papers at tracked venues · 10 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ICLR
×4
AAAI
×2
ICML
×2
NeurIPS
×2
IJCAI
×1
Frequent coauthors
Shuze Daniel Liu
DBLP profile ↗
ORCID search ↗
×3
Jiuqi Wang
DBLP profile ↗
ORCID search ↗
×2
Ethan Blaser
DBLP profile ↗
ORCID search ↗
×1
Shuyang Dong
DBLP profile ↗
ORCID search ↗
×1
Claire Chen
DBLP profile ↗
ORCID search ↗
×1
Zixuan Xie
DBLP profile ↗
ORCID search ↗
×1
Xinyu Liu
DBLP profile ↗
ORCID search ↗
×1
Xiaochi Qian
DBLP profile ↗
ORCID search ↗
×1
Papers
Asymptotic and Finite Sample Analysis of Nonexpansive Stochastic Approximations with Markovian Noise
AAAI 2026
·
Ethan Blaser
DBLP profile ↗
ORCID search ↗
Counterfactual Explanations for Continuous Action Reinforcement Learning
IJCAI 2025
·
Shuyang Dong
DBLP profile ↗
ORCID search ↗
Doubly Optimal Policy Evaluation for Reinforcement Learning
ICLR 2025
·
Shuze Daniel Liu
DBLP profile ↗
ORCID search ↗
Efficient Multi-Policy Evaluation for Reinforcement Learning
AAAI 2025
·
Shuze Daniel Liu
DBLP profile ↗
ORCID search ↗
Efficient Policy Evaluation with Safety Constraint for Reinforcement Learning
ICLR 2025
·
Claire Chen
DBLP profile ↗
ORCID search ↗
Finite Sample Analysis of Linear Temporal Difference Learning with Arbitrary Features
NeurIPS 2025
·
Zixuan Xie
DBLP profile ↗
ORCID search ↗
Linear Q-Learning Does Not Diverge in L2: Convergence Rates to a Bounded Set
ICML 2025
·
Xinyu Liu
DBLP profile ↗
ORCID search ↗
Revisiting a Design Choice in Gradient Temporal Difference Learning
ICLR 2025
·
Xiaochi Qian
DBLP profile ↗
ORCID search ↗
Towards Provable Emergence of In-Context Reinforcement Learning
NeurIPS 2025
·
Jiuqi Wang
DBLP profile ↗
ORCID search ↗
Transformers Can Learn Temporal Difference Methods for In-Context Reinforcement Learning
ICLR 2025
·
Jiuqi Wang
DBLP profile ↗
ORCID search ↗
Efficient Policy Evaluation with Offline Data Informed Behavior Policy Design
ICML 2024
·
Shuze Daniel Liu
DBLP profile ↗
ORCID search ↗