PPaperPicks

Dawei Leng

8 papers at tracked venues · 8 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Bridge Diffusion Model: Bridge Chinese Text-to-Image Diffusion Model with English Communities
  2. FG-CLIP: Fine-Grained Visual and Textual Alignment
  3. IAA: Inner-Adaptor Architecture Empowers Frozen Large Language Model with Multimodal Capabilities
  4. LMM-Det: Make Large Multimodal Models Excel in Object Detection
  5. PT-T2I/V: An Efficient Proxy-Tokenized Diffusion Transformer for Text-to-Image/Video-Task
  6. PlanGen: Towards Unified Layout Planning and Image Generation in Auto-Regressive Vision Language Models
  7. Prompt as Knowledge Bank: Boost Vision-language model via Structural Representation for zero-shot medical detection
  8. HiCo: Hierarchical Controllable Diffusion Model for Layout-to-image Generation