PPaperPicks

Xiaoyue Duan

6 papers at tracked venues · 6 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. F2RVLM: Boosting Fine-grained Fragment Retrieval for Multi-Modal Long-form Dialogue with Vision Language Model
  2. Enhancing Visual Reliance in Text Generation: A Bayesian Perspective on Mitigating Hallucination in Large Vision-Language Models
  3. MCID: Multi-aspect Copyright Infringement Detection for Generated Images
  4. Secret Lies in Color: Enhancing AI-Generated Images Detection with Color Distribution Analysis
  5. WalkVLM: Aid Visually Impaired People Walking by Vision Language Model
  6. Tuning-Free Inversion-Enhanced Control for Consistent Image Editing
    AAAI 2024 · Xiaoyue Duan