PPaperPicks

Xiaoteng Ma

9 papers at tracked venues · 9 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. From Word to World: Can Large Language Models be Implicit Text-based World Models?
  2. Self-Sum: Teaching an Agent to Decide Itself When and What to Summarize
  3. Cross-Domain Offline Policy Adaptation with Optimal Transport and Dataset Constraint
  4. Episodic Novelty Through Temporal Distance
  5. Efficient Multi-agent Reinforcement Learning by Planning
  6. Learning Diverse Risk Preferences in Population-Based Self-Play
  7. NeuralPlane: An Efficiently Parallelizable Platform for Fixed-wing Aircraft Control with Reinforcement Learning
  8. SEABO: A Simple Search-Based Method for Offline Imitation Learning
  9. Single-Trajectory Distributionally Robust Reinforcement Learning