P
PaperPicks
Conferences
Qingpei Guo
16 papers at tracked venues · 14 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×4
CVPR
×3
ACL
×2
NeurIPS
×2
ICCV
×1
ICML
×1
IJCAI
×1
SIGIR
×1
WSDM
×1
Frequent coauthors
Yuyan Chen
DBLP profile ↗
ORCID search ↗
×4
Zhanzhou Feng
DBLP profile ↗
ORCID search ↗
×2
Linglin Jing
DBLP profile ↗
ORCID search ↗
×1
Qixin Sun
DBLP profile ↗
ORCID search ↗
×1
Yudong Han
DBLP profile ↗
ORCID search ↗
×1
Muzhi Zhu
DBLP profile ↗
ORCID search ↗
×1
Yutao Chen
DBLP profile ↗
ORCID search ↗
×1
Wei Wu
DBLP profile ↗
ORCID search ↗
×1
Xingning Dong
DBLP profile ↗
ORCID search ↗
×1
Shiyu Xuan
DBLP profile ↗
ORCID search ↗
×1
Yabing Wang
DBLP profile ↗
ORCID search ↗
×1
Ziping Ma
DBLP profile ↗
ORCID search ↗
×1
Papers
EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models
AAAI 2026
·
Linglin Jing
DBLP profile ↗
ORCID search ↗
SCAN: Self-Calibrated AutoregressioN for High-Quality Visual Generation
AAAI 2026
·
Zhanzhou Feng
DBLP profile ↗
ORCID search ↗
VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples
AAAI 2026
·
Qixin Sun
DBLP profile ↗
ORCID search ↗
Attributive Reasoning for Hallucination Diagnosis of Large Language Models
AAAI 2025
·
Yuyan Chen
DBLP profile ↗
ORCID search ↗
DynFocus: Dynamic Cooperative Network Empowers LLMs with Video Understanding
CVPR 2025
·
Yudong Han
DBLP profile ↗
ORCID search ↗
MedTransTab: Advancing Medical Cross-Table Tabular Data Generation
WSDM 2025
·
Yuyan Chen
DBLP profile ↗
ORCID search ↗
SegAgent: Exploring Pixel Understanding Capabilities in MLLMs by Imitating Human Annotator Trajectories
CVPR 2025
·
Muzhi Zhu
DBLP profile ↗
ORCID search ↗
Unified Visual Generation via Next-Set Prediction in Continuous Domain
ICCV 2025
·
Zhanzhou Feng
DBLP profile ↗
ORCID search ↗
VQAGuider: Guiding Multimodal Large Language Models to Answer Complex Video Questions
ACL 2025
·
Yuyan Chen
DBLP profile ↗
ORCID search ↗
EVE: Efficient Zero-Shot Text-Based Video Editing With Depth Map Guidance and Temporal Consistency Constraints
IJCAI 2024
·
Yutao Chen
DBLP profile ↗
ORCID search ↗
HOTVCOM: Generating Buzzworthy Comments for Videos
ACL 2024
·
Yuyan Chen
DBLP profile ↗
ORCID search ↗
LoTLIP: Improving Language-Image Pre-training for Long Text Understanding
NeurIPS 2024
·
Wei Wu
DBLP profile ↗
ORCID search ↗
M2-RAAP: A Multi-Modal Recipe for Advancing Adaptation-based Pre-training towards Effective and Efficient Zero-shot Video-text Retrieval
SIGIR 2024
·
Xingning Dong
DBLP profile ↗
ORCID search ↗
Pink: Unveiling the Power of Referential Comprehension for Multi-modal LLMs
CVPR 2024
·
Shiyu Xuan
DBLP profile ↗
ORCID search ↗
Referencing Where to Focus: Improving Visual Grounding with Referential Query
NeurIPS 2024
·
Yabing Wang
DBLP profile ↗
ORCID search ↗
SyCoCa: Symmetrizing Contrastive Captioners with Attentive Masking for Multimodal Alignment
ICML 2024
·
Ziping Ma
DBLP profile ↗
ORCID search ↗