P
PaperPicks
Conferences
Tianpei Yang
16 papers at tracked venues · 11 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0002-5497-7146 ↗
Venues
AAAI
×4
AAMAS
×4
ACL
×2
ICLR
×2
NeurIPS
×2
ICML
×1
IJCAI
×1
Frequent coauthors
Hongye Cao
DBLP profile ↗
ORCID search ↗
×3
Linjian Meng
DBLP profile ↗
ORCID search ↗
×3
Kai Chen
DBLP profile ↗
ORCID search ↗
×1
Siyuan Gan
DBLP profile ↗
ORCID search ↗
×1
Guang Yang
DBLP profile ↗
ORCID search ↗
×1
Taher Jafferjee
DBLP profile ↗
ORCID search ↗
×1
Sheila Schoepp
DBLP profile ↗
ORCID search ↗
×1
Yihong Chen
DBLP profile ↗
ORCID search ↗
×1
Hao Zhang
DBLP profile ↗
ORCID search ↗
×1
Jizhou Wu
DBLP profile ↗
ORCID search ↗
×1
Papers
Causality-Aware Efficient Exploration for Cooperative Multi-Agent Reinforcement Learning
AAAI 2026
·
Hongye Cao
DBLP profile ↗
ORCID search ↗
Faster Game Solving via Asymmetry of Step Sizes
AAAI 2026
·
Linjian Meng
DBLP profile ↗
ORCID search ↗
MDTeamGPT: Mitigating Context Collapse and Enabling Self-Evolution in Medical Multi-Agent Reasoning
ACL 2026
·
Kai Chen
DBLP profile ↗
ORCID search ↗
Thinking-Based Non-Thinking: Solving the Reward Hacking Problem in Training Hybrid Reasoning Models via Reinforcement Learning
ACL 2026
·
Siyuan Gan
DBLP profile ↗
ORCID search ↗
Causal Information Prioritization for Efficient Reinforcement Learning
ICLR 2025
·
Hongye Cao
DBLP profile ↗
ORCID search ↗
Efficient Last-Iterate Convergence in Solving Extensive-Form Games
NeurIPS 2025
·
Linjian Meng
DBLP profile ↗
ORCID search ↗
Empowering Generalization for Deep Reinforcement Learning via Symbolic Planning
AAMAS 2025
·
Tianpei Yang
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
NeurIPS 2025
·
Guang Yang
DBLP profile ↗
ORCID search ↗
Reducing Variance of Stochastic Optimization for Approximating Nash Equilibria in Normal-Form Games
ICML 2025
·
Linjian Meng
DBLP profile ↗
ORCID search ↗
Taming Multi-Agent Reinforcement Learning with Estimator Variance Reduction
AAMAS 2025
·
Taher Jafferjee
DBLP profile ↗
ORCID search ↗
The Evolving Landscape of LLM- and VLM-Integrated Reinforcement Learning
IJCAI 2025
·
Sheila Schoepp
DBLP profile ↗
ORCID search ↗
Towards Empowerment Gain through Causal Structure Learning in Model-Based Reinforcement Learning
ICLR 2025
·
Hongye Cao
DBLP profile ↗
ORCID search ↗
A Transfer Approach Using Graph Neural Networks in Deep Reinforcement Learning
AAAI 2024
·
Tianpei Yang
Mastering Robot Control through Point-based Reinforcement Learning with Pre-training
AAMAS 2024
·
Yihong Chen
DBLP profile ↗
ORCID search ↗
PADDLE: Logic Program Guided Policy Reuse in Deep Reinforcement Learning
AAMAS 2024
·
Hao Zhang
DBLP profile ↗
ORCID search ↗
PORTAL: Automatic Curricula Generation for Multiagent Reinforcement Learning
AAAI 2024
·
Jizhou Wu
DBLP profile ↗
ORCID search ↗