PPaperPicks

Nanyi Fei

3 papers at tracked venues · 3 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Leveraging Large Vision-Language Model as User Intent-Aware Encoder for Composed Image Retrieval
  2. FineCLIP: Self-distilled Region-based CLIP for Better Fine-grained Understanding
  3. VDT: General-purpose Video Diffusion Transformers via Mask Modeling