PPaperPicks

Kai Han

Huawei Technologies, Noah's Ark Lab

22 papers at tracked venues · 18 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers
  2. PocketLLM: Ultimate Compression of Large Language Models via Meta Networks
  3. DenseSSM: State Space Models with Dense Hidden Connection for Efficient Large Language Models
  4. EMS-SD: Efficient Multi-sample Speculative Decoding for Accelerating Large Language Models
  5. Eve: Efficient Multimodal Vision Language Models with Elastic Visual Experts
  6. Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
  7. GPT4Image: Large Pre-trained Models Help Vision Models Learn Better on Perception Task
  8. L-Man: A Large Multi-modal Model Unifying Human-centric Tasks
  9. LLM Data Selection and Utilization via Dynamic Bi-level Optimization
  10. Mixture of Lookup Experts
  11. SpeCache: Speculative Key-Value Caching for Efficient Generation of LLMs
  12. Adapt Without Forgetting: Distill Proximity from Dual Teachers in Vision-Language Models
  13. An Empirical Study of Scaling Law for Scene Text Recognition
  14. Data-efficient Large Vision Models through Sequential Autoregression
  15. GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer
  16. Kangaroo: Lossless Self-Speculative Decoding for Accelerating LLMs via Double Early Exiting
  17. Memory-Space Visual Prompting for Efficient Vision-Language Fine-Tuning
  18. MemoryFormer : Minimize Transformer Computation by Removing Fully-Connected Layers
  19. ParameterNet: Parameters are All You Need for Large-Scale Visual Pretraining of Mobile Networks
    CVPR 2024 · Kai Han
  20. Rethinking Optimization and Architecture for Tiny Language Models
  21. Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning
  22. Token Compensator: Altering Inference Cost of Vision Transformer Without Re-tuning