PPaperPicks

Yanai Elazar

15 papers at tracked venues · 10 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Calibrating Large Language Models with Sample Consistency
  2. Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data
  3. Hybrid Preferences: Learning to Route Instances for Human vs. AI Feedback
    ACL 2025 ·
    Lester James Validad Miranda
  4. OLMoTrace: Tracing Language Model Outputs Back to Trillions of Training Tokens
  5. On Linear Representations and Pretraining Data Frequency in Language Models
  6. Applying Intrinsic Debiasing on Downstream Tasks: Challenges and Considerations for Machine Translation
  7. Backtracking Mathematical Reasoning of Language Models to the Pretraining Data
  8. Detection and Measurement of Syntactic Templates in Generated Text
  9. Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research
  10. Evaluating n-Gram Novelty of Language Models Using Rusty-DAWG
  11. Measuring and Improving Attentiveness to Partial Inputs with Counterfactuals
    EMNLP 2024 · Yanai Elazar
  12. OLMo: Accelerating the Science of Language Models
  13. Paloma: A Benchmark for Evaluating Language Model Fit
  14. The Bias Amplification Paradox in Text-to-Image Generation
  15. What's In My Big Data?
    ICLR 2024 · Yanai Elazar