PPaperPicks

Yi Wu

Tsinghua University, Institute of Interdisciplinary Information Sciences (IIIS), Beijing, China

21 papers at tracked venues · 11 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. How Far Are We from Optimal Reasoning Efficiency?
  2. Learning Strategic Language Agents in the Werewolf Game with Iterative Latent Space Policy Optimization
  3. Long-horizon Locomotion and Manipulation on a Quadrupedal Robot with Large Language Models
  4. Multi-UAV Formation Control with Static and Dynamic Obstacle Avoidance via Reinforcement Learning
  5. Offline Reinforcement Learning for LLM Multi-step Reasoning
  6. ReaL: Efficient RLHF Training of Large Language Models with Parameter Reallocation
  7. Reasoning Is Not a Race: When Stopping Early Beats Going Deeper
  8. What Can RL Bring to VLA Generalization? An Empirical Study
  9. Accelerate Multi-Agent Reinforcement Learning in Zero-Sum Games with Subgame Curriculum Learning
  10. Adaptive-Gradient Policy Optimization: Enhancing Policy Learning in Non-Smooth Differentiable Simulations
  11. Is DPO Superior to PPO for LLM Alignment? A Comprehensive Study
  12. LAGOON: Language-Guided Motion Control
  13. LLM-Powered Hierarchical Language Agent for Real-time Human-AI Coordination
  14. Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
  15. Learning Agile Bipedal Motions on a Quadrupedal Robot
  16. Leveraging Symmetry in RL-based Legged Locomotion Control
  17. MESA: Cooperative Meta-Exploration in Multi-Agent Learning through Exploiting State-Action Space Structure
  18. Robot Generating Data for Learning Generalizable Visual Robotic Manipulation
  19. Robot Synesthesia: In-Hand Manipulation with Visuotactile Sensing
  20. SRL: Scaling Distributed Reinforcement Learning to Over Ten Thousand Cores
  21. Stylized Offline Reinforcement Learning: Extracting Diverse High-Quality Behaviors from Heterogeneous Datasets