PPaperPicks

Dongyan Zhao

Peking University, Institute of Computer Science and Technology, China

36 papers at tracked venues · 22 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models
  2. Curriculum Learning based Hierarchical Scoring and Analysis Framework for Question Answering Task Evaluation
  3. MARS: Multimodal Adaptive Reasoning Model for Avoiding Overthinking
  4. Shorten After You're Right: Lazy Length Penalties for Reasoning RL
  5. We May Not Need Much Visual Encoding of Web Data for Question Answering
  6. AnaFig: A Human-Aligned Dataset for Scientific Figure Analysis
  7. Efficient Domain Continual pretraining by Mitigating the Stability Gap
  8. English as Defense Proxy: Mitigating Multilingual Jailbreak via Eliciting English Safety Knowledge
  9. EpiCoDe: Boosting Model Performance Beyond Training with Extrapolation and Contrastive Decoding
  10. F2TEval: Human-Aligned Multi-Dimensional Evaluation for Figure-to-Text Task
  11. Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding
  12. Latent Preference Coding: Aligning Large Language Models via Discrete Latent Codes
  13. OmniMMI: A Comprehensive Multi-modal Interaction Benchmark in Streaming Video Contexts
  14. QAEval: Mixture of Evaluators for Question-Answering Task Evaluation
  15. ReMamba: Equip Mamba with Effective Long-Sequence Modeling
  16. ReasVQA: Advancing VideoQA with Imperfect Reasoning Process
  17. RetriEVAL: Evaluating Text Generation with Contextualized Lexical Match
  18. Understanding Visual Detail Hallucinations of Large Vision-Language Models
  19. VideoLLM Knows When to Speak: Enhancing Time-Sensitive Video Comprehension with Video-Text Duet Interaction Format
  20. Bi-Directional Multi-Granularity Generation Framework for Knowledge Graph-to-Text with Large Language Model
  21. Disentangled Representations for Continual Learning: Overcoming Forgetting and Facilitating Knowledge Transfer
  22. Efficient Temporal Extrapolation of Multimodal Large Language Models with Temporal Grounding Bridge
  23. Graph-Structured Speculative Decoding
  24. Language Models can be Deductive Solvers
  25. Large Language Models Can Learn Representation in Natural Language
  26. Learning to Plan by Updating Natural Language
  27. Mixture-of-Modules: Reinventing Transformers as Dynamic Assemblies of Modules
  28. PPTC Benchmark: Evaluating Large Language Models for PowerPoint Task Completion
  29. PPTC-R benchmark: Towards Evaluating the Robustness of Large Language Models for PowerPoint Task Completion
  30. SCALE: Synergized Collaboration of Asymmetric Language Translation Engines
  31. STAIR: Spatial-Temporal Reasoning with Auditable Intermediate Results for Video Question Answering
  32. Synergistic Interplay between Search and Large Language Models for Information Retrieval
  33. Unlocking the Potential of Model Merging for Low-Resource Languages
  34. What Makes Quantization for Large Language Model Hard? An Empirical Study from the Lens of Perturbation
  35. Your Career Path Matters in Person-Job Fit
  36. xRAG: Extreme Context Compression for Retrieval-augmented Generation with One Token