PPaperPicks

Yongyu Mu

10 papers at tracked venues · 8 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. GRAM-R²: Self-Training Generative Foundation Reward Models for Reward Reasoning
  2. LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance
  3. Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
  4. Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
  5. GRAM: A Generative Foundation Reward Model for Reward Generalization
  6. Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
  7. MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
  8. RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
  9. Hybrid Alignment Training for Large Language Models
  10. Revealing the Parallel Multilingual Learning within Large Language Models
    EMNLP 2024 · Yongyu Mu