PPaperPicks

Yuzhong Hong

3 papers at tracked venues · 3 at CORE A* · active 20252025

Venues

Frequent coauthors

Papers

  1. Energy-Based Preference Model Offers Better Offline Alignment than the Bradley-Terry Preference Model
    ICML 2025 · Yuzhong Hong
  2. GVPO: Group Variance Policy Optimization for Large Language Model Post-Training
  3. Preference-Oriented Supervised Fine-Tuning: Favoring Target Model over Aligned Large Language Models