PPaperPicks

Qingpei Guo

16 papers at tracked venues · 14 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models
  2. SCAN: Self-Calibrated AutoregressioN for High-Quality Visual Generation
  3. VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples
  4. Attributive Reasoning for Hallucination Diagnosis of Large Language Models
  5. DynFocus: Dynamic Cooperative Network Empowers LLMs with Video Understanding
  6. MedTransTab: Advancing Medical Cross-Table Tabular Data Generation
  7. SegAgent: Exploring Pixel Understanding Capabilities in MLLMs by Imitating Human Annotator Trajectories
  8. Unified Visual Generation via Next-Set Prediction in Continuous Domain
  9. VQAGuider: Guiding Multimodal Large Language Models to Answer Complex Video Questions
  10. EVE: Efficient Zero-Shot Text-Based Video Editing With Depth Map Guidance and Temporal Consistency Constraints
  11. HOTVCOM: Generating Buzzworthy Comments for Videos
  12. LoTLIP: Improving Language-Image Pre-training for Long Text Understanding
  13. M2-RAAP: A Multi-Modal Recipe for Advancing Adaptation-based Pre-training towards Effective and Efficient Zero-shot Video-text Retrieval
  14. Pink: Unveiling the Power of Referential Comprehension for Multi-modal LLMs
  15. Referencing Where to Focus: Improving Visual Grounding with Referential Query
  16. SyCoCa: Symmetrizing Contrastive Captioners with Attentive Masking for Multimodal Alignment