P
PaperPicks
Conferences
Chunyuan Li
19 papers at tracked venues · 13 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
ICLR
×5
CVPR
×4
ECCV
×4
NAACL
×2
AAAI
×1
ACL
×1
ICML
×1
NeurIPS
×1
Frequent coauthors
Feng Li
DBLP profile ↗
ORCID search ↗
×3
Shilong Liu
DBLP profile ↗
ORCID search ↗
×2
Lu Xu
DBLP profile ↗
ORCID search ↗
×1
Ruohong Zhang
DBLP profile ↗
ORCID search ↗
×1
Yutao Cheng
DBLP profile ↗
ORCID search ↗
×1
Tianyi Xiong
DBLP profile ↗
ORCID search ↗
×1
Kaichen Zhang
DBLP profile ↗
ORCID search ↗
×1
Dongzhi Jiang
DBLP profile ↗
ORCID search ↗
×1
Fei Wang
DBLP profile ↗
ORCID search ↗
×1
Qinghao Ye
DBLP profile ↗
ORCID search ↗
×1
Zhiqing Sun
DBLP profile ↗
ORCID search ↗
×1
Haotian Liu
DBLP profile ↗
ORCID search ↗
×1
Papers
Beyond Raw Videos: Understanding Edited Videos with Large Multimodal Model
CVPR 2025
·
Lu Xu
DBLP profile ↗
ORCID search ↗
Direct Preference Optimization of Video Large Multimodal Models from Language Model Reward
NAACL 2025
·
Ruohong Zhang
DBLP profile ↗
ORCID search ↗
Graphic Design with Large Multimodal Model
AAAI 2025
·
Yutao Cheng
DBLP profile ↗
ORCID search ↗
LLaVA-Critic: Learning to Evaluate Multimodal Models
CVPR 2025
·
Tianyi Xiong
DBLP profile ↗
ORCID search ↗
LLaVA-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models
ICLR 2025
·
Feng Li
DBLP profile ↗
ORCID search ↗
LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models
NAACL 2025
·
Kaichen Zhang
DBLP profile ↗
ORCID search ↗
MMSearch: Unveiling the Potential of Large Models as Multi-modal Search Engines
ICLR 2025
·
Dongzhi Jiang
DBLP profile ↗
ORCID search ↗
MuirBench: A Comprehensive Benchmark for Robust Multi-image Understanding
ICLR 2025
·
Fei Wang
DBLP profile ↗
ORCID search ↗
Painting with Words: Elevating Detailed Image Captioning with Benchmark and Alignment Learning
ICLR 2025
·
Qinghao Ye
DBLP profile ↗
ORCID search ↗
Aligning Large Multimodal Models with Factually Augmented RLHF
ACL 2024
·
Zhiqing Sun
DBLP profile ↗
ORCID search ↗
Grounding DINO: Marrying DINO with Grounded Pre-training for Open-Set Object Detection
ECCV 2024
·
Shilong Liu
DBLP profile ↗
ORCID search ↗
Improved Baselines with Visual Instruction Tuning
CVPR 2024
·
Haotian Liu
DBLP profile ↗
ORCID search ↗
LLaVA-Grounding: Grounded Visual Chat with Large Multimodal Models
ECCV 2024
·
Hao Zhang
DBLP profile ↗
ORCID search ↗
LLaVA-Plus: Learning to Use Tools for Creating Multimodal Agents
ECCV 2024
·
Shilong Liu
DBLP profile ↗
ORCID search ↗
MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts
ICLR 2024
·
Pan Lu
DBLP profile ↗
ORCID search ↗
Position: TrustLLM: Trustworthiness in Large Language Models
ICML 2024
·
Yue Huang
DBLP profile ↗
ORCID search ↗
Seeing the Image: Prioritizing Visual Correlation by Contrastive Alignment
NeurIPS 2024
·
Xin Xiao
DBLP profile ↗
ORCID search ↗
Segment and Recognize Anything at Any Granularity
ECCV 2024
·
Feng Li
DBLP profile ↗
ORCID search ↗
Visual in-Context Prompting
CVPR 2024
·
Feng Li
DBLP profile ↗
ORCID search ↗