PPaperPicks

Tongran Liu

9 papers at tracked venues · 7 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
  2. SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models
  3. GRAM: A Generative Foundation Reward Model for Reward Generalization
  4. HEAL: A Hypothesis-Based Preference-Aware Analysis Framework
  5. MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
  6. RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
  7. ESRL: Efficient Sampling-Based Reinforcement Learning for Sequence Generation
  8. Hybrid Alignment Training for Large Language Models
  9. Revealing the Parallel Multilingual Learning within Large Language Models