PPaperPicks

Zhongang Qi

16 papers at tracked venues · 15 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. CustomCrafter: Customized Video Generation with Preserving Motion and Concept Composition Abilities
  2. DOGR: Towards Versatile Visual Document Grounding and Referring
  3. Less is More: Empowering GUI Agent with Context-Aware Simplification
  4. Mamba-3VL: Taming State Space Model for 3D Vision Language Learning
  5. Mono2Stereo: A Benchmark and Empirical Study for Stereo Conversion
  6. Taming Rectified Flow for Inversion and Editing
  7. UniPixel: Unified Object Referring and Segmentation for Pixel-Level Visual Reasoning
  8. CustomNet: Object Customization with Variable-Viewpoints in Text-to-Image Diffusion Models
  9. E.T. Bench: Towards Open-Ended Event-Level Video-Language Understanding
  10. EA-VTR: Event-Aware Video-Text Retrieval
  11. How to Make Cross Encoder a Good Teacher for Efficient Image-Text Retrieval?
  12. PhotoMaker: Customizing Realistic Human Photos via Stacked ID Embedding
  13. RecDCL: Dual Contrastive Learning for Recommendation
  14. SphereDiffusion: Spherical Geometry-Aware Distortion Resilient Diffusion Model
  15. SynopGround: A Large-Scale Dataset for Multi-Paragraph Video Grounding from TV Dramas and Synopses
  16. T2I-Adapter: Learning Adapters to Dig Out More Controllable Ability for Text-to-Image Diffusion Models