PPaperPicks

Yifu Huo

8 papers at tracked venues · 7 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. GRAM-R²: Self-Training Generative Foundation Reward Models for Reward Reasoning
  2. Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
  3. SERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams
  4. SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models
    ACL 2026 · Yifu Huo
  5. GRAM: A Generative Foundation Reward Model for Reward Generalization
  6. HEAL: A Hypothesis-Based Preference-Aware Analysis Framework
    EMNLP 2025 · Yifu Huo
  7. RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
  8. ESRL: Efficient Sampling-Based Reinforcement Learning for Sequence Generation