P
PaperPicks
Conferences
Qiang Fu
15 papers at tracked venues · 13 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ICLR
×5
AAAI
×3
ICML
×3
NeurIPS
×2
IJCAI
×1
UAI
×1
Frequent coauthors
Yuheng Jing
DBLP profile ↗
ORCID search ↗
×4
Hang Xu
DBLP profile ↗
ORCID search ↗
×3
Jinmin He
DBLP profile ↗
ORCID search ↗
×3
Hanlin Yang
DBLP profile ↗
ORCID search ↗
×1
Xinyue Zheng
DBLP profile ↗
ORCID search ↗
×1
Canzhe Zhao
DBLP profile ↗
ORCID search ↗
×1
Yiming Gao
DBLP profile ↗
ORCID search ↗
×1
Jiarong Liu
DBLP profile ↗
ORCID search ↗
×1
Papers
Deep (Predictive) Discounted Counterfactual Regret Minimization
AAAI 2026
·
Hang Xu
DBLP profile ↗
ORCID search ↗
An Open-Ended Learning Framework for Opponent Modeling
AAAI 2025
·
Yuheng Jing
DBLP profile ↗
ORCID search ↗
Diverse Policies Recovering via Pointwise Mutual Information Weighted Imitation Learning
ICLR 2025
·
Hanlin Yang
DBLP profile ↗
ORCID search ↗
Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning
ICML 2025
·
Jinmin He
DBLP profile ↗
ORCID search ↗
MCU: An Evaluation Framework for Open-Ended Game Agents
ICML 2025
·
Xinyue Zheng
DBLP profile ↗
ORCID search ↗
Offline Opponent Modeling with Truncated Q-driven Instant Policy Refinement
ICML 2025
·
Yuheng Jing
DBLP profile ↗
ORCID search ↗
Towards Provably Efficient Learning of Imperfect Information Extensive-Form Games with Linear Function Approximation
UAI 2025
·
Canzhe Zhao
DBLP profile ↗
ORCID search ↗
Dynamic Discounted Counterfactual Regret Minimization
ICLR 2024
·
Hang Xu
DBLP profile ↗
ORCID search ↗
Efficient Multi-task Reinforcement Learning with Cross-Task Policy Guidance
NeurIPS 2024
·
Jinmin He
DBLP profile ↗
ORCID search ↗
Enhancing Human Experience in Human-Agent Collaboration: A Human-Centered Modeling Approach Based on Positive Human Gain
ICLR 2024
·
Yiming Gao
DBLP profile ↗
ORCID search ↗
Maximum Entropy Heterogeneous-Agent Reinforcement Learning
ICLR 2024
·
Jiarong Liu
DBLP profile ↗
ORCID search ↗
Minimizing Weighted Counterfactual Regret with Optimistic Online Mirror Descent
IJCAI 2024
·
Hang Xu
DBLP profile ↗
ORCID search ↗
Not All Tasks Are Equally Difficult: Multi-Task Deep Reinforcement Learning with Dynamic Depth Routing
AAAI 2024
·
Jinmin He
DBLP profile ↗
ORCID search ↗
Opponent Modeling with In-context Search
NeurIPS 2024
·
Yuheng Jing
DBLP profile ↗
ORCID search ↗
Towards Offline Opponent Modeling with In-context Learning
ICLR 2024
·
Yuheng Jing
DBLP profile ↗
ORCID search ↗