P
PaperPicks
Conferences
Katherine Metcalf
8 papers at tracked venues · 7 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ICML
×3
ACL
×2
AAAI
×1
EMNLP
×1
ICLR
×1
Frequent coauthors
Arnav Arora
DBLP profile ↗
ORCID search ↗
×1
Stéphane Aroca-Ouellette
DBLP profile ↗
ORCID search ↗
×1
Yinong Oliver Wang
DBLP profile ↗
ORCID search ↗
×1
Anirudh Sundar
DBLP profile ↗
ORCID search ↗
×1
Mudit Verma
DBLP profile ↗
ORCID search ↗
×1
Yong Lin
DBLP profile ↗
ORCID search ↗
×1
Xavier Suau
DBLP profile ↗
ORCID search ↗
×1
Papers
How Value Induction Reshapes LLM Behavior
ACL 2026
·
Arnav Arora
DBLP profile ↗
ORCID search ↗
Aligning LLMs by Predicting Preferences from User Writing Samples
ICML 2025
·
Stéphane Aroca-Ouellette
DBLP profile ↗
ORCID search ↗
Is Your Model Fairly Certain? Uncertainty-Aware Fairness Evaluation for LLMs
ICML 2025
·
Yinong Oliver Wang
DBLP profile ↗
ORCID search ↗
Steering into New Embedding Spaces: Analyzing Cross-Lingual Alignment Induced by Model Interventions in Multilingual Language Models
ACL 2025
·
Anirudh Sundar
DBLP profile ↗
ORCID search ↗
Can You Rely on Synthetic Labellers in Preference-Based Reinforcement Learning? It's Complicated
AAAI 2024
·
Katherine Metcalf
Hindsight PRIORs for Reward Learning from Human Preferences
ICLR 2024
·
Mudit Verma
DBLP profile ↗
ORCID search ↗
On the Limited Generalization Capability of the Implicit Reward Model Induced by Direct Preference Optimization
EMNLP 2024
·
Yong Lin
DBLP profile ↗
ORCID search ↗
Whispering Experts: Neural Interventions for Toxicity Mitigation in Language Models
ICML 2024
·
Xavier Suau
DBLP profile ↗
ORCID search ↗