PPaperPicks

Junwei Bao

5 papers at tracked venues · 4 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Energy-Based Preference Model Offers Better Offline Alignment than the Bradley-Terry Preference Model
  2. GVPO: Group Variance Policy Optimization for Large Language Model Post-Training
  3. Multi-Turn Interactions for Text-to-SQL with Large Language Models
  4. Preference-Oriented Supervised Fine-Tuning: Favoring Target Model over Aligned Large Language Models
  5. Interactive-KBQA: Multi-Turn Interactions for Knowledge Base Question Answering with Large Language Models