PPaperPicks

Sushant Prakash

3 papers at tracked venues · 3 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. RLPF: Reinforcement Learning from Prediction Feedback for User Summarization with LLMs
  2. User-LLM: Efficient LLM Contextualization with User Embeddings
  3. RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback