P
PaperPicks
Conferences
Hangyu Mao
13 papers at tracked venues · 8 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAMAS
×2
ICML
×2
IJCAI
×2
WWW
×2
AAAI
×1
ACL
×1
EMNLP
×1
SIGIR
×1
SIGKDD
×1
Frequent coauthors
Guanting Dong
DBLP profile ↗
ORCID search ↗
×2
Rong Cheng
DBLP profile ↗
ORCID search ↗
×1
Zhiwei Xu
DBLP profile ↗
ORCID search ↗
×1
Yibin Chen
DBLP profile ↗
ORCID search ↗
×1
Yongyan Wen
DBLP profile ↗
ORCID search ↗
×1
Jingqing Ruan
DBLP profile ↗
ORCID search ↗
×1
Jiaming Lu
DBLP profile ↗
ORCID search ↗
×1
Yiqun Chen
DBLP profile ↗
ORCID search ↗
×1
Bin Zhang
DBLP profile ↗
ORCID search ↗
×1
Yilun Kong
DBLP profile ↗
ORCID search ↗
×1
Haoyuan Jiang
DBLP profile ↗
ORCID search ↗
×1
Papers
Tool-Star: Empowering Multi-Tool Collaborative Web Agent via Reinforcement Learning
SIGIR 2026
·
Guanting Dong
DBLP profile ↗
ORCID search ↗
Toward Generalized Web Agent Training: A Deep Dive into Entropy-Balanced Reinforcement Learning
WWW 2026
·
Guanting Dong
DBLP profile ↗
ORCID search ↗
DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
ACL 2025
·
Rong Cheng
DBLP profile ↗
ORCID search ↗
Reidentify: Context-Aware Identity Generation for Contextual Multi-Agent Reinforcement Learning
ICML 2025
·
Zhiwei Xu
DBLP profile ↗
ORCID search ↗
SheetAgent: Towards a Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models
WWW 2025
·
Yibin Chen
DBLP profile ↗
ORCID search ↗
SkillTree: Explainable Skill-Based Deep Reinforcement Learning for Long-Horizon Control Tasks
AAAI 2025
·
Yongyan Wen
DBLP profile ↗
ORCID search ↗
CoSLight: Co-optimizing Collaborator Selection and Decision-making to Enhance Traffic Signal Control
SIGKDD 2024
·
Jingqing Ruan
DBLP profile ↗
ORCID search ↗
DuaLight: Enhancing Traffic Signal Control by Leveraging Scenario-Specific and Scenario-Shared Knowledge
AAMAS 2024
·
Jiaming Lu
DBLP profile ↗
ORCID search ↗
PDiT: Interleaving Perception and Decision-making Transformers for Deep Reinforcement Learning
AAMAS 2024
·
Hangyu Mao
PTDE: Personalized Training with Distilled Execution for Multi-Agent Reinforcement Learning
IJCAI 2024
·
Yiqun Chen
DBLP profile ↗
ORCID search ↗
Sequential Asynchronous Action Coordination in Multi-Agent Systems: A Stackelberg Decision Transformer Approach
ICML 2024
·
Bin Zhang
DBLP profile ↗
ORCID search ↗
TPTU-v2: Boosting Task Planning and Tool Usage of Large Language Model-based Agents in Real-world Industry Systems
EMNLP 2024
·
Yilun Kong
DBLP profile ↗
ORCID search ↗
X-Light: Cross-City Traffic Signal Control Using Transformer on Transformer as Meta Multi-Agent Reinforcement Learner
IJCAI 2024
·
Haoyuan Jiang
DBLP profile ↗
ORCID search ↗