PPaperPicks

Haobo Fu

17 papers at tracked venues · 14 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Deep (Predictive) Discounted Counterfactual Regret Minimization
  2. An Open-Ended Learning Framework for Opponent Modeling
  3. Diverse Policies Recovering via Pointwise Mutual Information Weighted Imitation Learning
  4. Enhanced Equilibria-Solving via Private Information Pre-Branch Structure in Adversarial Team Games
  5. Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning
  6. Learning Preferences without Interaction for Cooperative AI: A Hybrid Offline-Online Approach
  7. MCU: An Evaluation Framework for Open-Ended Game Agents
  8. Offline Opponent Modeling with Truncated Q-driven Instant Policy Refinement
  9. Online-to-Offline RL for Agent Alignment
  10. Towards Provably Efficient Learning of Imperfect Information Extensive-Form Games with Linear Function Approximation
  11. Dynamic Discounted Counterfactual Regret Minimization
  12. Efficient Multi-task Reinforcement Learning with Cross-Task Policy Guidance
  13. Maximum Entropy Heterogeneous-Agent Reinforcement Learning
  14. Minimizing Weighted Counterfactual Regret with Optimistic Online Mirror Descent
  15. Not All Tasks Are Equally Difficult: Multi-Task Deep Reinforcement Learning with Dynamic Depth Routing
  16. Opponent Modeling with In-context Search
  17. Towards Offline Opponent Modeling with In-context Learning