PPaperPicks

Hui Chen

Tsinghua University, School of Software, Beijing, China

26 papers at tracked venues · 12 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. AdaTP: Attention-Debiased Token Pruning for Video Large Language Models
  2. Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations
  3. CartesianMoE: Boosting Knowledge Sharing among Experts via Cartesian Product Routing in Mixture-of-Experts
  4. DSMoE: Matrix-Partitioned Experts with Dynamic Routing for Computation-Efficient Dense LLMs
  5. Exploiting Position Information in Convolutional Kernels for Structural Re-parameterization
  6. Extending LLM Context Window with Adaptive Grouped Positional Encoding: A Training-Free Method
  7. Fast Quiet-STaR: Thinking Without Thought Tokens
  8. LSNet: See Large, Focus Small
  9. Mitigating Hallucinations in Multi-modal Large Language Models via Image Token Attention-Guided Decoding
  10. PrefixKV: Adaptive Prefix KV Cache is What Vision Instruction-Following Models Need for Efficient Generation
  11. Promptable Anomaly Segmentation with SAM Through Self-Perception Tuning
  12. Scaffold-BPE: Enhancing Byte Pair Encoding for Large Language Models with Simple and Effective Scaffold Token Removal
  13. Temporal Scaling Law for Large Language Models
  14. YOLOE: Real-Time Seeing Anythi
  15. Context Enhancement with Reconstruction as Sequence for Unified Unsupervised Anomaly Detection
  16. Geometry-Guided Domain Generalization for Monocular 3D Object Detection
  17. Learn from the Learnt: Source-Free Active Domain Adaptation via Contrastive Sampling and Visual Persistence
  18. MiLe Loss: a New Loss for Mitigating the Bias of Learning Difficulties in Generative Language Models
  19. More is Better: Deep Domain Adaptation with Multiple Sources
  20. Multi-Label Learning with Block Diagonal Labels
  21. One-dimensional Adapter to Rule Them All: Concepts, Diffusion Models and Erasing Applications
  22. PYRA: Parallel Yielding Re-activation for Training-Inference Efficient Task Adaptation
  23. Quantized Prompt for Efficient Generalization of Vision-Language Models
  24. Rep ViT: Revisiting Mobile CNN From ViT Perspective
  25. TaD: A Plug-and-Play Task-Aware Decoding Method to Better Adapt LLMs on Downstream Tasks
  26. YOLOv10: Real-Time End-to-End Object Detection