P
PaperPicks
Conferences
Chenjun Xiao
12 papers at tracked venues · 11 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ICML
×5
NeurIPS
×3
AAAI
×2
AAMAS
×1
ACL
×1
Frequent coauthors
Hongming Zhang
DBLP profile ↗
ORCID search ↗
×2
Yi Ma
DBLP profile ↗
ORCID search ↗
×2
Yangchen Pan
DBLP profile ↗
ORCID search ↗
×1
Jiahang Sun
DBLP profile ↗
ORCID search ↗
×1
Chen-Xiao Gao
DBLP profile ↗
ORCID search ↗
×1
Dmitry Shribak
DBLP profile ↗
ORCID search ↗
×1
Haoyu Ma
DBLP profile ↗
ORCID search ↗
×1
Xiaotian Hao
DBLP profile ↗
ORCID search ↗
×1
Hongming Zhang
DBLP profile ↗
ORCID search ↗
×1
Fengdi Che
DBLP profile ↗
ORCID search ↗
×1
Papers
An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models (Abstract Reprint)
AAAI 2026
·
Yangchen Pan
DBLP profile ↗
ORCID search ↗
Large Language Model-Enhanced Multi-Armed Bandits
ACL 2026
·
Jiahang Sun
DBLP profile ↗
ORCID search ↗
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
ICML 2025
·
Chen-Xiao Gao
DBLP profile ↗
ORCID search ↗
β-DQN: Improving Deep Q-Learning By Evolving the Behavior
AAMAS 2025
·
Hongming Zhang
DBLP profile ↗
ORCID search ↗
Diffusion Spectral Representation for Reinforcement Learning
NeurIPS 2024
·
Dmitry Shribak
DBLP profile ↗
ORCID search ↗
Exploiting the Replay Memory Before Exploring the Environment: Enhancing Reinforcement Learning Through Empirical MDP Iteration
NeurIPS 2024
·
Hongming Zhang
DBLP profile ↗
ORCID search ↗
HarmonyDream: Task Harmonization Inside World Models
ICML 2024
·
Haoyu Ma
DBLP profile ↗
ORCID search ↗
Iteratively Refined Behavior Regularization for Offline Reinforcement Learning
NeurIPS 2024
·
Yi Ma
DBLP profile ↗
ORCID search ↗
Multiagent Gumbel MuZero: Efficient Planning in Combinatorial Action Spaces
AAAI 2024
·
Xiaotian Hao
DBLP profile ↗
ORCID search ↗
Provable Representation with Efficient Planning for Partially Observable Reinforcement Learning
ICML 2024
·
Hongming Zhang
DBLP profile ↗
ORCID search ↗
Rethinking Decision Transformer via Hierarchical Reinforcement Learning
ICML 2024
·
Yi Ma
DBLP profile ↗
ORCID search ↗
Target Networks and Over-parameterization Stabilize Off-policy Bootstrapping with Function Approximation
ICML 2024
·
Fengdi Che
DBLP profile ↗
ORCID search ↗