P
PaperPicks
Conferences
Fengyun Rao
17 papers at tracked venues · 17 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
CVPR
×7
ICCV
×4
AAAI
×3
NeurIPS
×2
ICLR
×1
Frequent coauthors
Feipeng Ma
DBLP profile ↗
ORCID search ↗
×3
Liang Xu
DBLP profile ↗
ORCID search ↗
×2
Tao Zhang
DBLP profile ↗
ORCID search ↗
×1
Yunzhu Zhang
DBLP profile ↗
ORCID search ↗
×1
Yucheng Suo
DBLP profile ↗
ORCID search ↗
×1
Zhixiang Wei
DBLP profile ↗
ORCID search ↗
×1
Zitang Zhou
DBLP profile ↗
ORCID search ↗
×1
Zitian Wang
DBLP profile ↗
ORCID search ↗
×1
Xinli Yue
DBLP profile ↗
ORCID search ↗
×1
Jian Yang
DBLP profile ↗
ORCID search ↗
×1
Yongliang Wu
DBLP profile ↗
ORCID search ↗
×1
Cong Chen
DBLP profile ↗
ORCID search ↗
×1
Papers
MMhops-R1: Multimodal Multi-hop Reasoning
AAAI 2026
·
Tao Zhang
DBLP profile ↗
ORCID search ↗
FlexSelect: Flexible Token Selection for Efficient Long Video Understanding
NeurIPS 2025
·
Yunzhu Zhang
DBLP profile ↗
ORCID search ↗
From Trial to Triumph: Advancing Long Video Understanding via Visual Context Sample Scaling and Self-Reward Alignment
ICCV 2025
·
Yucheng Suo
DBLP profile ↗
ORCID search ↗
HQ-CLIP: Leveraging Large Vision-Language Models to Create High-Quality Image-Text Datasets and CLIP Models
ICCV 2025
·
Zhixiang Wei
DBLP profile ↗
ORCID search ↗
HarmonySet: A Comprehensive Dataset for Understanding Video-Music Semantic Alignment and Temporal Synchronization
CVPR 2025
·
Zitang Zhou
DBLP profile ↗
ORCID search ↗
Instruction-Oriented Preference Alignment for Enhancing Multi-Modal Comprehension Capability of MLLMs
ICCV 2025
·
Zitian Wang
DBLP profile ↗
ORCID search ↗
Instruction-augmented Multimodal Alignment for Image-Text and Element Matching
CVPR 2025
·
Xinli Yue
DBLP profile ↗
ORCID search ↗
MMAR: Towards Lossless Multi-Modal Auto-Regressive Probabilistic Modeling
CVPR 2025
·
Jian Yang
DBLP profile ↗
ORCID search ↗
Number it: Temporal Grounding Videos like Flipping Manga
CVPR 2025
·
Yongliang Wu
DBLP profile ↗
ORCID search ↗
PerturboLLaVA: Reducing Multimodal Hallucinations with Perturbative Visual Training
ICLR 2025
·
Cong Chen
DBLP profile ↗
ORCID search ↗
R1-Onevision: Advancing Generalized Multimodal Reasoning Through Cross-Modal Formalization
ICCV 2025
·
Yi Yang
DBLP profile ↗
ORCID search ↗
Image Captioning with Multi-Context Synthetic Data
AAAI 2024
·
Feipeng Ma
DBLP profile ↗
ORCID search ↗
Inter-X: Towards Versatile Human-Human Interaction Analysis
CVPR 2024
·
Liang Xu
DBLP profile ↗
ORCID search ↗
ReGenNet: Towards Human Action-Reaction Synthesis
CVPR 2024
·
Liang Xu
DBLP profile ↗
ORCID search ↗
Spatial-Semantic Collaborative Cropping for User Generated Content
AAAI 2024
·
Yukun Su
DBLP profile ↗
ORCID search ↗
Task Navigator: Decomposing Complex Tasks for Multimodal Large Language Models
CVPR 2024
·
Feipeng Ma
DBLP profile ↗
ORCID search ↗
Visual Perception by Large Language Model's Weights
NeurIPS 2024
·
Feipeng Ma
DBLP profile ↗
ORCID search ↗