PPaperPicks

Nanyun Peng

University of Southern California, Los Angeles, CA, USA

79 papers at tracked venues · 44 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. BRIEF-Pro: Universal Context Compression with Short-to-Long Synthesis for Fast and Accurate Multi-Hop Reasoning
  2. Beyond Facts- Benchmarking Distributional Reading Comprehension in Large Language Models
  3. CoLyricist: Enhancing Lyric Writing with AI through Workflow-Aligned Support
  4. Decoupling Task-Solving and Output Formatting in LLM Generation
  5. LiveCLKTBench: Towards Reliable Evaluation of Cross-Lingual Knowledge Transfer in Multilingual LLMs
  6. MM-PoisonRAG: Disrupting Multimodal RAG with Local and Global Knowledge Poisoning Attacks
  7. Rethinking Creativity Evaluation: A Critical Analysis of Existing Creativity Evaluations
  8. 3DLLM-Mem: Long-Term Spatial-Temporal Memory for Embodied 3D Large Language Model
  9. AI Debate Aids Assessment of Controversial Claims
  10. BRIEF: Bridging Retrieval and Inference for Multi-hop Reasoning via Compression
  11. CaKE: Circuit-aware Editing Enables Generalizable Knowledge Learners
  12. Collapse of Dense Retrievers: Short, Early, and Literal Biases Outranking Factual Evidence
  13. Comparing Bad Apples to Good Oranges Aligning Large Language Models via Joint Preference Optimization
  14. Contrastive Visual Data Augmentation
  15. DRS: Deep Question Reformulation With Structured Output
  16. DiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning
  17. Evaluating Cultural and Social Awareness of LLM Web Agents
  18. FLAMES: Improving LLM Math Reasoning via a Fine-Grained Analysis of the Data Synthesis Pipeline
  19. Guiding Through Complexity: What Makes Good Supervision for Hard Reasoning Tasks?
  20. How to Make Large Language Models Generate 100% Valid Molecules?
  21. Improving Faithfulness of Text-to-Image Diffusion Models through Inference Intervention
  22. METAL: A Multi-Agent Framework for Chart Generation with Test-Time Scaling
  23. MRAG-Bench: Vision-Centric Evaluation for Retrieval-Augmented Multimodal Models
  24. Mind the Gesture: Evaluating AI Sensitivity to Culturally Offensive Non-Verbal Gestures
  25. Model Extrapolation Expedites Alignment
  26. On the Loss of Context Awareness in General Instruction Fine-tuning
  27. OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles
  28. PARTONOMY: Large Multimodal Models with Part-Level Visual Understanding
  29. REFFLY: Melody-Constrained Lyrics Editing Model
  30. SNaRe: Domain-aware Data Generation for Low-Resource Event Detection
  31. SYNTHIA: Novel Concept Design with Affordance Composition
  32. Sandcastles in the Storm: Revisiting the (Im)possibility of Strong Watermarking
  33. Scaling Probabilistic Circuits via Monarch Matrices
  34. SkillVerse : Assessing and Enhancing LLMs with Tree Evaluation
  35. VISCO: Benchmarking Fine-Grained Critique and Correction Towards Self-Improvement in Visual Reasoning
  36. Verbalized Representation Learning for Interpretable Few-Shot Generalization
  37. Vulnerability of LLMs to Vertically Aligned Text Manipulations
  38. Vulnerability of Large Language Models to Output Prefix Jailbreaks: Impact of Positions on Safety
  39. AMRFact: Enhancing Summarization Factuality Evaluation with AMR-Driven Negative Samples Generation
  40. Adaptable Logical Control for Large Language Models
  41. Are Large Language Models Capable of Generating Human-Level Narratives?
  42. Argument-Aware Approach To Event Linking
  43. CaLM: Contrasting Large and Small Language Models to Verify Grounded Generation
  44. ConTextual: Evaluating Context-Sensitive Text-Rich Visual Reasoning in Large Multimodal Models
  45. Contextual Label Projection for Cross-Lingual Structured Prediction
  46. Control Large Language Models via Divide and Conquer
  47. DACO: Towards Application-Driven and Comprehensive Data Analysis via Code Generation
  48. Detecting Machine-Generated Long-Form Content with Latent-Space Variables
  49. DiNADO: Norm-Disentangled Neurally-Decomposed Oracles for Controlling Language Models
  50. Do LLMs Plan Like Human Writers? Comparing Journalist Coverage of Press Releases with LLMs
  51. Event Detection from Social Media for Epidemic Prediction
  52. Explaining Mixtures of Sources in News Articles
  53. Explaining and Improving Contrastive Decoding by Extrapolating the Probabilities of a Huge and Hypothetical LM
  54. Human-in-the-Loop Synthetic Text Data Inspection with Provenance Tracking
  55. Improving Event Definition Following For Zero-Shot Event Detection
  56. LLM Self-Correction with DeCRIM: Decompose, Critique, and Refine for Enhanced Following of Instructions with Multiple Constraints
  57. LLM-A*: Large Language Model Enhanced Incremental Heuristic Search on Path Planning
  58. MIDDAG: Where Does Our News Go? Investigating Information Diffusion via Community-Level Information Pathways
  59. MIRACLE: An Online, Explainable Multimodal Interactive Concept Learning System
  60. MacGyver: Are Large Language Models Creative Problem Solvers?
  61. Matryoshka Query Transformer for Large Vision-Language Models
  62. Measuring Psychological Depth in Language Models
  63. Mitigating Bias for Question Answering Models by Tracking Bias Influence
  64. Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue
  65. New Job, New Gender? Measuring the Social Bias in Image Generation Models
  66. On Prompt-Driven Safeguarding for Large Language Models
  67. Open-Domain Text Evaluation via Contrastive Distribution Methods
  68. QUDSELECT: Selective Decoding for Questions Under Discussion Parsing
  69. RLCD: Reinforcement Learning from Contrastive Distillation for LM Alignment
  70. Re-ReST: Reflection-Reinforced Self-Training for Language Agents
  71. SPEED++: A Multilingual Event Extraction Framework for Epidemic Prediction and Preparedness
  72. STAR: Boosting Low-Resource Information Extraction by Structure-to-Text Data Generation with Large Language Models
  73. SafeWorld: Geo-Diverse Safety Alignment
  74. Synchronous Faithfulness Monitoring for Trustworthy Retrieval-Augmented Generation
  75. TextEE: Benchmark, Reevaluation, Reflections, and Future Challenges in Event Extraction
  76. Tracking the Newsworthiness of Public Documents
  77. Uncertainty Calibration for Tool-Using Language Agents
  78. VALOR-EVAL: Holistic Coverage and Faithfulness Evaluation of Large Vision-Language Models
  79. VDebugger: Harnessing Execution Feedback for Debugging Visual Programs