P
PaperPicks
Conferences
Elizabeth M. Daly
IBM Research, Dublin, Ireland
19 papers at tracked venues · 11 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0003-0162-3683 ↗
Homepage ↗
Venues
AAAI
×5
ACL
×3
EMNLP
×3
NAACL
×2
NeurIPS
×2
ECAI
×1
ECML-PKDD
×1
IUI
×1
UIST
×1
Frequent coauthors
Erik Miehling
DBLP profile ↗
ORCID search ↗
×3
Inge Vejsbjerg
DBLP profile ↗
ORCID search ↗
×2
Aris Hofmann
DBLP profile ↗
ORCID search ↗
×1
Javier Carnerero-Cano
DBLP profile ↗
ORCID search ↗
×1
Svetoslav Nizhnichenkov
DBLP profile ↗
ORCID search ↗
×1
Anna Sokol
DBLP profile ↗
ORCID search ↗
×1
Zahra Ashktorab
DBLP profile ↗
ORCID search ↗
×1
Michael Desmond
DBLP profile ↗
ORCID search ↗
×1
Radu Marinescu
DBLP profile ↗
ORCID search ↗
×1
Inkit Padhi
DBLP profile ↗
ORCID search ↗
×1
James McCarthy
DBLP profile ↗
ORCID search ↗
×1
Martín Santillán Cooper
DBLP profile ↗
ORCID search ↗
×1
Papers
AI Steerability 360: A Toolkit for Steering Large Language Models
ACL 2026
·
Erik Miehling
DBLP profile ↗
ORCID search ↗
Auto-BenchmarkCard: Automated Synthesis of Benchmark Documentation
AAAI 2026
·
Aris Hofmann
DBLP profile ↗
ORCID search ↗
FactCorrector: A Graph-Inspired Approach to Long-Form Factuality Correction of Large Language Models
ACL 2026
·
Javier Carnerero-Cano
DBLP profile ↗
ORCID search ↗
MIRAGE: Misleading Impacts Resulting from AI Generated Explanations (Workshop)
IUI 2026
·
Elizabeth M. Daly
Risk Atlas Nexus: A System for Managing AI Risks
AAAI 2026
·
Inge Vejsbjerg
DBLP profile ↗
ORCID search ↗
A Representation-Level Assessment of Bias Mitigation in Foundation Models
ECML-PKDD 2025
·
Svetoslav Nizhnichenkov
DBLP profile ↗
ORCID search ↗
BenchmarkCards: Standardized Documentation for Large Language Model Benchmarks
NeurIPS 2025
·
Anna Sokol
DBLP profile ↗
ORCID search ↗
EvalAssist: Insights on Task-Specific Evaluations and AI-Assisted Judgment Strategy Preferences
UIST 2025
·
Zahra Ashktorab
DBLP profile ↗
ORCID search ↗
EvalAssist: LLM-as-a-Judge Simplified
AAAI 2025
·
Michael Desmond
DBLP profile ↗
ORCID search ↗
Evaluating the Prompt Steerability of Large Language Models
NAACL 2025
·
Erik Miehling
DBLP profile ↗
ORCID search ↗
FactReasoner: A Probabilistic Approach to Long-Form Factuality Assessment for Large Language Models
EMNLP 2025
·
Radu Marinescu
DBLP profile ↗
ORCID search ↗
Granite Guardian: Comprehensive LLM Safeguarding
NAACL 2025
·
Inkit Padhi
DBLP profile ↗
ORCID search ↗
Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning
ECAI 2025
·
James McCarthy
DBLP profile ↗
ORCID search ↗
Synthetic Data for Evaluation: Supporting LLM-as-a-Judge Workflows with EvalAssist
EMNLP 2025
·
Martín Santillán Cooper
DBLP profile ↗
ORCID search ↗
Usage Governance Advisor: From Intent to AI Governance
AAAI 2025
·
Elizabeth M. Daly
Interactive Human-Centric Bias Mitigation
AAAI 2024
·
Inge Vejsbjerg
DBLP profile ↗
ORCID search ↗
Language Models in Dialogue: Conversational Maxims for Human-AI Interactions
EMNLP 2024
·
Erik Miehling
DBLP profile ↗
ORCID search ↗
Ranking Large Language Models without Ground Truth
ACL 2024
·
Amit Dhurandhar
DBLP profile ↗
ORCID search ↗
WikiContradict: A Benchmark for Evaluating LLMs on Real-World Knowledge Conflicts from Wikipedia
NeurIPS 2024
·
Yufang Hou
DBLP profile ↗
ORCID search ↗