P
PaperPicks
Conferences
Ying Wen
Shanghai Jiao Tong University, China
18 papers at tracked venues · 15 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0003-1247-2382 ↗
Google Scholar ↗
Homepage ↗
Venues
NeurIPS
×6
ACL
×4
AAAI
×2
AAMAS
×2
ICML
×2
ECAI
×1
SIGIR
×1
Frequent coauthors
Fengshuo Bai
DBLP profile ↗
ORCID search ↗
×2
Ziyu Wan
DBLP profile ↗
ORCID search ↗
×2
Jingxiao Chen
DBLP profile ↗
ORCID search ↗
×1
Huacan Chai
DBLP profile ↗
ORCID search ↗
×1
Jianghao Lin
DBLP profile ↗
ORCID search ↗
×1
Jiesong Lian
DBLP profile ↗
ORCID search ↗
×1
Shao Zhang
DBLP profile ↗
ORCID search ↗
×1
Kun Hu
DBLP profile ↗
ORCID search ↗
×1
Jiachen Zhu
DBLP profile ↗
ORCID search ↗
×1
Shulin Huang
DBLP profile ↗
ORCID search ↗
×1
Yingxuan Yang
DBLP profile ↗
ORCID search ↗
×1
Yang Li
DBLP profile ↗
ORCID search ↗
×1
Papers
Offline Fictitious Self-Play for Competitive Games
AAAI 2026
·
Jingxiao Chen
DBLP profile ↗
ORCID search ↗
Progra: Progress-Aware Reinforcement Learning for Multi-Turn Function Calling
ACL 2026
·
Huacan Chai
DBLP profile ↗
ORCID search ↗
ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling
ACL 2026
·
Jianghao Lin
DBLP profile ↗
ORCID search ↗
Fusion-PSRO: Nash Policy Fusion for Policy Space Response Oracles
ECAI 2025
·
Jiesong Lian
DBLP profile ↗
ORCID search ↗
Leveraging Dual Process Theory in Language Agent Framework for Real-time Simultaneous Human-AI Collaboration
ACL 2025
·
Shao Zhang
DBLP profile ↗
ORCID search ↗
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
AAMAS 2025
·
Kun Hu
DBLP profile ↗
ORCID search ↗
RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors
AAAI 2025
·
Fengshuo Bai
DBLP profile ↗
ORCID search ↗
ReMA: Learning to Meta-Think for LLMs with Multi-agent Reinforcement Learning
NeurIPS 2025
·
Ziyu Wan
DBLP profile ↗
ORCID search ↗
Retrieval-Augmented Process Reward Model for Generalizable Mathematical Reasoning
ACL 2025
·
Jiachen Zhu
DBLP profile ↗
ORCID search ↗
STAR: Efficient Preference-based Reinforcement Learning via Dual Regularization
NeurIPS 2025
·
Fengshuo Bai
DBLP profile ↗
ORCID search ↗
ThinkBench: Dynamic Out-of-Distribution Evaluation for Robust LLM Reasoning
NeurIPS 2025
·
Shulin Huang
DBLP profile ↗
ORCID search ↗
Unlocking the Potential of Decentralized LLM-based MAS: Privacy Preservation and Monetization in Collective Intelligence
AAMAS 2025
·
Yingxuan Yang
DBLP profile ↗
ORCID search ↗
Aligning Individual and Collective Objectives in Multi-Agent Cooperation
NeurIPS 2024
·
Yang Li
DBLP profile ↗
ORCID search ↗
AlphaZero-Like Tree-Search can Guide Large Language Model Decoding and Training
ICML 2024
·
Ziyu Wan
DBLP profile ↗
ORCID search ↗
DS-Agent: Automated Data Science by Empowering Large Language Models with Case-Based Reasoning
ICML 2024
·
Siyuan Guo
DBLP profile ↗
ORCID search ↗
Reinforcing LLM Agents via Policy Optimization with Action Decomposition
NeurIPS 2024
·
Muning Wen
DBLP profile ↗
ORCID search ↗
TRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision
SIGIR 2024
·
Ruiwen Zhou
DBLP profile ↗
ORCID search ↗
ZSC-Eval: An Evaluation Toolkit and Benchmark for Multi-agent Zero-shot Coordination
NeurIPS 2024
·
Xihuai Wang
DBLP profile ↗
ORCID search ↗