PPaperPicks

Hangfan Zhang

5 papers at tracked venues · 4 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Do We Truly Need So Many Samples? Multi-LLM Repeated Sampling Efficiently Scales Test-Time Compute
  2. Explainable Reinforcement Learning from Human Feedback to Improve Alignment
  3. Reinforcement Learning for Large Language Models via Group Preference Reward Shaping
  4. Simple Distillation for One-Step Diffusion Models
  5. Jailbreak Open-Sourced Large Language Models via Enforced Decoding
    ACL 2024 · Hangfan Zhang