PPaperPicks

Yingsen Zeng

4 papers at tracked venues · 3 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ViType: High-Fidelity Visual Text Rendering via Glyph-Aware Multimodal Diffusion
  2. DisTime: Distribution-Based Time Representation for Video Large Language Models
    ICCV 2025 · Yingsen Zeng
  3. Instructseg: Unifying Instructed Visual Segmentation with Multi-Modal Large Language Models
  4. UniMD: Towards Unifying Moment Retrieval and Temporal Action Detection
    ECCV 2024 · Yingsen Zeng