PPaperPicks

Yiyi Zhou

14 papers at tracked venues · 14 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Vision-language Incremental Learning with Dual Class-individual Memory
  2. Accelerating Multimodal Large Language Models via Dynamic Visual-Token Exit and the Empirical Findings
  3. DViN: Dynamic Visual Routing Network for Weakly Supervised Referring Expression Comprehension
  4. Feast Your Eyes: Mixture-of-Resolution Adaptation for Multimodal Large Language Models
  5. Fit and Prune: Fast and Training-free Visual Token Pruning for Multi-modal Large Language Models
  6. FlashSloth : Lightning Multimodal Large Language Models via Embedded Visual Compression
  7. Routing Experts: Learning to Route Dynamic Experts in Existing Multi-modal Large Language Models
  8. SVFR: A Unified Framework for Generalized Video Face Restoration
  9. What Kind of Visual Tokens Do We Need? Training-Free Visual Token Pruning for Multi-Modal Large Language Models from the Perspective of Graph
  10. γ-MoD: Exploring Mixture-of-Depth Adaptation for Multimodal Large Language Models
  11. Deep Instruction Tuning for Segment Anything Model
  12. Fast Text-to-3D-Aware Face Generation and Manipulation via Direct Cross-modal Mapping and Geometric Regularization
  13. QueryMatch: A Query-based Contrastive Learning Framework for Weakly Supervised Visual Grounding
  14. Towards Efficient Diffusion-Based Image Editing with Instant Attention Masks