PPaperPicks

Abhinav Rastogi

3 papers at tracked venues · 2 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. MoDE: Effective Multi-task Parameter Efficient Fine-Tuning with a Mixture of Dyadic Experts
  2. Robust Multi-Objective Preference Alignment with Online DPO
  3. RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback