PPaperPicks

Yixiu Mao

8 papers at tracked venues · 8 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?
  2. Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
    NeurIPS 2025 · Yixiu Mao
  3. Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
  4. Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
  5. Lessons and Winning Solutions in Industrial Object Detection and Pose Estimation from the 2025 Bin-Picking Perception Challenge
  6. Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation
  7. Doubly Mild Generalization for Offline Reinforcement Learning
    NeurIPS 2024 · Yixiu Mao
  8. Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression
    NeurIPS 2024 · Yixiu Mao