PPaperPicks

Yali Du

King's College London, London, UK

39 papers at tracked venues · 23 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Causality-Aware Efficient Exploration for Cooperative Multi-Agent Reinforcement Learning
  2. Entropy-Aware Reshaping of Reinforcement Signals for Multi-Answer Reasoning
  3. Safe Multi-agent Reinforcement Learning with Natural Language Constraints
  4. ATLAS: Agent Tuning via Learning Critical Steps
  5. Abstract Counterfactuals for Language Model Agents
  6. CODI: Compressing Chain-of-Thought into Continuous Space via Self-Distillation
  7. Causality Meets Locality: Provably Generalizable and Scalable Policy Learning for Networked Systems
  8. Ensemble Value Functions for Efficient Exploration in Multi-Agent Reinforcement Learning
  9. Evaluating Generalization Capabilities of LLM-Based Agents in Mixed-Motive Scenarios Using Concordia
  10. GRU: Mitigating the Trade-off between Unlearning and Retention for LLMs
  11. Hierarchical Multi-Agent Framework for Dynamic Macroeconomic Modelling Using Large Language Models
  12. Integrating Large Language Models with Reinforcement Learning for Generalization in Strategic Card Games
  13. M³HF: Multi-agent Reinforcement Learning from Multi-phase Human Feedback of Mixed Quality
  14. NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning
  15. On the Optimization Landscape of Low Rank Adaptation Methods for Large Language Models
  16. Quantifying the Self-Interest Level of Markov Social Dilemmas
  17. RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors
  18. Resolving Social Dilemmas with Minimal Reward Transfer - Extended Abstract
  19. RuAG: Learned-rule-augmented Generation for Large Language Models
  20. Self-Verifying Reflection Helps Transformers with CoT Reasoning
  21. Social World Model-Augmented Mechanism Design Policy Learning
  22. Spiral of Silence in Large Language Model Agents
  23. VLP: Vision-Language Preference Learning for Embodied Manipulation
  24. Will Systems of LLM Agents Lead to Cooperation: An Investigation into a Social Dilemma
  25. Aligning Individual and Collective Objectives in Multi-Agent Cooperation
  26. Characterizing Physical Adversarial Attacks on Robot Motion Planners
  27. Dual Contrastive Graph-Level Clustering with Multiple Cluster Perspectives Alignment
  28. Explaining an Agent's Future Beliefs Through Temporally Decomposing Future Reward Estimators
  29. Human-Guided Moral Decision Making in Text-Based Games
  30. Learning the Expected Core of Strictly Convex Stochastic Cooperative Games
  31. Learning to Discuss Strategically: A Case Study on One Night Ultimate Werewolf
  32. Off-Agent Trust Region Policy Optimization
  33. PEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation
  34. Policy Learning from Tutorial Books via Understanding, Rehearsing and Introspecting
  35. STAS: Spatial-Temporal Return Decomposition for Solving Sparse Rewards Problems in Multi-agent Reinforcement Learning
  36. Safe Reinforcement Learning with Free-form Natural Language Constraints and Pre-Trained Language Models
  37. Self-Guiding Exploration for Combinatorial Problems
  38. TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
  39. The Selfishness Level of Social Dilemmas