PPaperPicks

Jackie CK Cheung

29 papers at tracked venues · 20 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Active Learning with Non-Uniform Costs for African Natural Language Processing
    EACL 2026 ·
    Bonaventure F. P. Dossou
  2. Identifying and Analyzing Performance-Critical Tokens in Large Language Models
  3. (RSA)²: A Rhetorical-Strategy-Aware Rational Speech Act Framework for Figurative Language Understanding
    ACL 2025 ·
    Cesare Spinoso Di Piano
  4. Beyond the Safety Bundle: Auditing the Helpful and Harmless Dataset
  5. Can LLMs Reason Abstractly Over Math Word Problems Without CoT? Disentangling Abstract Formulation From Arithmetic Computation
  6. Collaborative Rational Speech Act: Pragmatic Reasoning for Multi-Turn Dialog
  7. Error Diversity Matters: An Error-Resistant Ensemble Method for Unsupervised Dependency Parsing
  8. Improving the Calibration of Confidence Scores in Text Generation Using the Output Distribution's Characteristics
    ACL 2025 ·
    Lorenzo Jaime Yu Flores
  9. Learning Task-Agnostic Representations through Multi-Teacher Distillation
  10. Neither Valid nor Reliable? Investigating the Use of LLMs as Judges
  11. PreSumm: Predicting Summarization Performance Without Summarizing
  12. Rethinking Full Finetuning from Pretraining Checkpoints in Active Learning for African Languages
    ACL 2025 ·
    Bonaventure F. P. Dossou
  13. Stochastic Chameleons: Irrelevant Context Hallucinations Reveal Class-Based (Mis)Generalization in LLMs
  14. Where Did That Come From? Sentence-Level Error-Tolerant Attribution
  15. CItruS: Chunked Instruction-aware State Eviction for Long Sequence Modeling
  16. COSMIC: Mutual Information for Task-Agnostic Summarization Evaluation
  17. Challenges to Evaluating the Generalization of Coreference Resolution Models: A Measurement Modeling Perspective
  18. Do LLMs Build World Representations? Probing Through the Lens of State Abstraction
  19. ECBD: Evidence-Centered Benchmark Design for NLP
  20. Ensemble Distillation for Unsupervised Constituency Parsing
  21. From Representational Harms to Quality-of-Service Harms: A Case Study on Llama 2 Safety Safeguards
  22. GLIMPSE: Pragmatically Informative Multi-Document Summarization for Scholarly Reviews
  23. How Teachers Can Use Large Language Models and Bloom's Taxonomy to Create Educational Quizzes
  24. Human-Centered Evaluation of Language Technologies
  25. Mechanistic Understanding and Mitigation of Language Model Non-Factual Hallucinations
  26. Separately Parameterizing Singleton Detection Improves End-to-end Neural Coreference Resolution
  27. Successor Features for Efficient Multi-Subject Controlled Text Generation
  28. Unsupervised Layer-Wise Score Aggregation for Textual OOD Detection
  29. When is an Embedding Model More Promising than Another?