PPaperPicks

Xiang An

13 papers at tracked venues · 9 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. UniME-V2: MLLM-as-a-Judge for Universal Multimodal Embedding Learning
  2. ViCToR: Improving Visual Comprehension via Token Reconstruction for Pretraining LMMs
  3. CLIP-CID: Efficient CLIP Distillation via Cluster-Instance Discrimination
  4. ForCenNet: Foreground-Centric Network for Document Image Rectification
  5. Gradient-Attention Guided Dual-Masking Synergetic Framework for Robust Text-based Person Retrieval
  6. HUST: High-Fidelity Unbiased Skin Tone Estimation via Texture Quantization
  7. ORID: Organ-Regional Information Driven Framework for Radiology Report Generation
  8. RealSyn: An Effective and Scalable Multimodal Interleaved Document Transformation Paradigm
  9. Region-based Cluster Discrimination for Visual Representation Learning
  10. UniViT: Unifying Image and Video Understanding in One Vision Encoder
  11. IDAdapter: Learning Mixed Features for Tuning-Free Personalization of Text-to-Image Models
  12. Multi-label Cluster Discrimination for Visual Representation Learning
    ECCV 2024 · Xiang An
  13. RWKV-CLIP: A Robust Vision-Language Representation Learner