PPaperPicks

Samrat Phatale

2 papers at tracked venues · 2 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Robust Multi-Objective Preference Alignment with Online DPO
  2. RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback