PPaperPicks

Ying Wen

Shanghai Jiao Tong University, China

18 papers at tracked venues · 15 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Offline Fictitious Self-Play for Competitive Games
  2. Progra: Progress-Aware Reinforcement Learning for Multi-Turn Function Calling
  3. ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling
  4. Fusion-PSRO: Nash Policy Fusion for Policy Space Response Oracles
  5. Leveraging Dual Process Theory in Language Agent Framework for Real-time Simultaneous Human-AI Collaboration
  6. PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
  7. RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors
  8. ReMA: Learning to Meta-Think for LLMs with Multi-agent Reinforcement Learning
  9. Retrieval-Augmented Process Reward Model for Generalizable Mathematical Reasoning
  10. STAR: Efficient Preference-based Reinforcement Learning via Dual Regularization
  11. ThinkBench: Dynamic Out-of-Distribution Evaluation for Robust LLM Reasoning
  12. Unlocking the Potential of Decentralized LLM-based MAS: Privacy Preservation and Monetization in Collective Intelligence
  13. Aligning Individual and Collective Objectives in Multi-Agent Cooperation
  14. AlphaZero-Like Tree-Search can Guide Large Language Model Decoding and Training
  15. DS-Agent: Automated Data Science by Empowering Large Language Models with Case-Based Reasoning
  16. Reinforcing LLM Agents via Policy Optimization with Action Decomposition
  17. TRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision
  18. ZSC-Eval: An Evaluation Toolkit and Benchmark for Multi-agent Zero-shot Coordination