PPaperPicks

Zhenglun Kong

11 papers at tracked venues · 7 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Mutual Effort for Efficiency: A Similarity-based Token Pruning for Vision Transformers in Self-Supervised Learning
  2. Q-TempFusion: Quantization-Aware Temporal Multi-Sensor Fusion on Bird's-Eye View Representation
  3. Sparse Learning for State Space Models on Mobile
  4. Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
  5. Agile-Quant: Activation-Guided Quantization for Faster Inference of LLMs on the Edge
  6. Exploring Token Pruning in Vision State Space Models
  7. Fast and Memory-Efficient Video Diffusion Using Streamlined Inference
  8. FasterVD: On Acceleration of Video Diffusion Models
  9. Pruning Foundation Models for High Accuracy without Retraining
  10. Rethinking Token Reduction for State Space Models
  11. Search for Efficient Large Language Models