PPaperPicks

Manish Nagireddy

9 papers at tracked venues · 5 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Answering the Wrong Question: Reasoning Trace Inversion for Abstention in LLMs
  2. Granite Guardian: Comprehensive LLM Safeguarding
  3. Multi-Level Explanations for Generative Language Models
  4. Programming Refusal with Conditional Activation Steering
  5. ComVas: Contextual Moral Values Alignment System
  6. DARE to Diversify: DAta Driven and Diverse LLM REd Teaming
    SIGKDD 2024 · Manish Nagireddy
  7. Language Models in Dialogue: Conversational Maxims for Human-AI Interactions
  8. SocialStigmaQA: A Benchmark to Uncover Stigma Amplification in Generative Language Models
    AAAI 2024 · Manish Nagireddy
  9. Value Alignment from Unstructured Text