PPaperPicks

Elizabeth M. Daly

IBM Research, Dublin, Ireland

19 papers at tracked venues · 11 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AI Steerability 360: A Toolkit for Steering Large Language Models
  2. Auto-BenchmarkCard: Automated Synthesis of Benchmark Documentation
  3. FactCorrector: A Graph-Inspired Approach to Long-Form Factuality Correction of Large Language Models
  4. MIRAGE: Misleading Impacts Resulting from AI Generated Explanations (Workshop)
    IUI 2026 · Elizabeth M. Daly
  5. Risk Atlas Nexus: A System for Managing AI Risks
  6. A Representation-Level Assessment of Bias Mitigation in Foundation Models
  7. BenchmarkCards: Standardized Documentation for Large Language Model Benchmarks
  8. EvalAssist: Insights on Task-Specific Evaluations and AI-Assisted Judgment Strategy Preferences
  9. EvalAssist: LLM-as-a-Judge Simplified
  10. Evaluating the Prompt Steerability of Large Language Models
  11. FactReasoner: A Probabilistic Approach to Long-Form Factuality Assessment for Large Language Models
  12. Granite Guardian: Comprehensive LLM Safeguarding
  13. Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning
  14. Synthetic Data for Evaluation: Supporting LLM-as-a-Judge Workflows with EvalAssist
    EMNLP 2025 ·
    Martín Santillán Cooper
  15. Usage Governance Advisor: From Intent to AI Governance
    AAAI 2025 · Elizabeth M. Daly
  16. Interactive Human-Centric Bias Mitigation
  17. Language Models in Dialogue: Conversational Maxims for Human-AI Interactions
  18. Ranking Large Language Models without Ground Truth
  19. WikiContradict: A Benchmark for Evaluating LLMs on Real-World Knowledge Conflicts from Wikipedia