P
PaperPicks
Conferences
Muning Wen
12 papers at tracked venues · 10 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ACL
×3
ICLR
×2
NeurIPS
×2
AAAI
×1
AAMAS
×1
ECAI
×1
ICML
×1
SIGIR
×1
Frequent coauthors
Yingxuan Yang
DBLP profile ↗
ORCID search ↗
×2
Huacan Chai
DBLP profile ↗
ORCID search ↗
×1
Yiwei Shi
DBLP profile ↗
ORCID search ↗
×1
Jun Wang
DBLP profile ↗
ORCID search ↗
×1
Ning Li
DBLP profile ↗
ORCID search ↗
×1
Kun Hu
DBLP profile ↗
ORCID search ↗
×1
Qiqiang Lin
DBLP profile ↗
ORCID search ↗
×1
Shangding Gu
DBLP profile ↗
ORCID search ↗
×1
Ziyu Wan
DBLP profile ↗
ORCID search ↗
×1
Ruiwen Zhou
DBLP profile ↗
ORCID search ↗
×1
Papers
Attribution-Based Analysis and Optimization of Modular Agentic Workflows
ACL 2026
·
Yingxuan Yang
DBLP profile ↗
ORCID search ↗
Progra: Progress-Aware Reinforcement Learning for Multi-Turn Function Calling
ACL 2026
·
Huacan Chai
DBLP profile ↗
ORCID search ↗
Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation
AAAI 2025
·
Yiwei Shi
DBLP profile ↗
ORCID search ↗
Diversity-Aware Self-Paced Data Selection for LLM Fine-Tuning
ECAI 2025
·
Yingxuan Yang
DBLP profile ↗
ORCID search ↗
HammerBench: Fine-Grained Function-Calling Evaluation in Real Mobile Assistant Scenarios
ACL 2025
·
Jun Wang
DBLP profile ↗
ORCID search ↗
MobileUse: A Hierarchical Reflection-Driven GUI Agent for Autonomous Mobile Operation
NeurIPS 2025
·
Ning Li
DBLP profile ↗
ORCID search ↗
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
AAMAS 2025
·
Kun Hu
DBLP profile ↗
ORCID search ↗
Robust Function-Calling for On-Device Language Model via Function Masking
ICLR 2025
·
Qiqiang Lin
DBLP profile ↗
ORCID search ↗
Robust Gymnasium: A Unified Modular Benchmark for Robust Reinforcement Learning
ICLR 2025
·
Shangding Gu
DBLP profile ↗
ORCID search ↗
AlphaZero-Like Tree-Search can Guide Large Language Model Decoding and Training
ICML 2024
·
Ziyu Wan
DBLP profile ↗
ORCID search ↗
Reinforcing LLM Agents via Policy Optimization with Action Decomposition
NeurIPS 2024
·
Muning Wen
TRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision
SIGIR 2024
·
Ruiwen Zhou
DBLP profile ↗
ORCID search ↗