PPaperPicks

Tian Lan

10 papers at tracked venues · 7 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Reason in Chains, Learn in Trees: Self-Rectification and Grafting for Multi-turn Agent Policy Optimization
  2. Learning to Collaborate with Unknown Agents in the Absence of Reward
  3. MALinZero: Efficient Low-Dimensional Search for Mastering Complex Multi-Agent Planning
  4. Rack Position Optimization in Large-Scale Heterogeneous Data Centers
  5. Variational Offline Multi-agent Skill Discovery
  6. Bayesian Optimization through Gaussian Cox Process Models for Spatio-temporal Data
  7. ConcaveQ: Non-monotonic Value Function Factorization via Concave Representations in Deep Multi-Agent Reinforcement Learning
  8. Projection-Optimal Monotonic Value Function Factorization in Multi-Agent Reinforcement Learning
  9. RGMComm: Return Gap Minimization via Discrete Communications in Multi-Agent Reinforcement Learning
  10. RGMDT: Return-Gap-Minimizing Decision Tree Extraction in Non-Euclidean Metric Space