PPaperPicks

Yujie Zhong

16 papers at tracked venues · 15 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ViType: High-Fidelity Visual Text Rendering via Glyph-Aware Multimodal Diffusion
  2. Advancing Visual Large Language Model for Multi-Granular Versatile Perception
  3. CO-MOT: Boosting End-to-end Transformer-based Multi-Object Tracking via Coopetition Label Assignment and Shadow Sets
  4. DisTime: Distribution-Based Time Representation for Video Large Language Models
  5. HyperSeg: Hybrid Segmentation Assistant with Fine-grained Visual Perceiver
  6. Instructseg: Unifying Instructed Visual Segmentation with Multi-Modal Large Language Models
  7. Layer-Wise Vision Injection With Disentangled Attention for Efficient LVLMs
  8. Mr. DETR: Instructive Multi-Route Training for Detection Transformers
  9. RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving
  10. RoboTron-Sim: Improving Real-World Driving via Simulated Hard-Case
  11. TASR: Timestep-Aware Diffusion Model for Image Super-Resolution
  12. v-CLR: View-Consistent Learning for Open-World Instance Segmentation
  13. InstaGen: Enhancing Object Detection by Training on Synthetic Dataset
  14. Intelligent Grimm - Open-ended Visual Storytelling via Latent Diffusion Models
  15. UniMD: Towards Unifying Moment Retrieval and Temporal Action Detection
  16. When Phrases Meet Probabilities: Enabling Open Relation Extraction with Cooperating Large Language Models