PPaperPicks

Shangtong Zhang

11 papers at tracked venues · 10 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Asymptotic and Finite Sample Analysis of Nonexpansive Stochastic Approximations with Markovian Noise
  2. Counterfactual Explanations for Continuous Action Reinforcement Learning
  3. Doubly Optimal Policy Evaluation for Reinforcement Learning
  4. Efficient Multi-Policy Evaluation for Reinforcement Learning
  5. Efficient Policy Evaluation with Safety Constraint for Reinforcement Learning
  6. Finite Sample Analysis of Linear Temporal Difference Learning with Arbitrary Features
  7. Linear Q-Learning Does Not Diverge in L2: Convergence Rates to a Bounded Set
  8. Revisiting a Design Choice in Gradient Temporal Difference Learning
  9. Towards Provable Emergence of In-Context Reinforcement Learning
  10. Transformers Can Learn Temporal Difference Methods for In-Context Reinforcement Learning
  11. Efficient Policy Evaluation with Offline Data Informed Behavior Policy Design