P
PaperPicks
Conferences
Zehuan Yuan
14 papers at tracked venues · 12 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
CVPR
×5
NeurIPS
×5
AAAI
×2
BMVC
×1
ECCV
×1
Frequent coauthors
Chuofan Ma
DBLP profile ↗
ORCID search ↗
×2
Haosen Yang
DBLP profile ↗
ORCID search ↗
×2
Shilong Zhang
DBLP profile ↗
ORCID search ↗
×1
Shoufa Chen
DBLP profile ↗
ORCID search ↗
×1
Jian Han
DBLP profile ↗
ORCID search ↗
×1
Jinlai Liu
DBLP profile ↗
ORCID search ↗
×1
Liao Qu
DBLP profile ↗
ORCID search ↗
×1
Junyi Chen
DBLP profile ↗
ORCID search ↗
×1
Junfeng Wu
DBLP profile ↗
ORCID search ↗
×1
Chuang Lin
DBLP profile ↗
ORCID search ↗
×1
Junke Wang
DBLP profile ↗
ORCID search ↗
×1
Keyu Tian
DBLP profile ↗
ORCID search ↗
×1
Papers
FlashVideo: Flowing Fidelity to Detail for Efficient High-Resolution Video Generation
AAAI 2026
·
Shilong Zhang
DBLP profile ↗
ORCID search ↗
Goku: Flow Based Video Generative Foundation Models
CVPR 2025
·
Shoufa Chen
DBLP profile ↗
ORCID search ↗
Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis
CVPR 2025
·
Jian Han
DBLP profile ↗
ORCID search ↗
InfinityStar: Unified Spacetime AutoRegressive Modeling for Visual Generation
NeurIPS 2025
·
Jinlai Liu
DBLP profile ↗
ORCID search ↗
TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation
CVPR 2025
·
Liao Qu
DBLP profile ↗
ORCID search ↗
UniTok: a Unified Tokenizer for Visual Generation and Understanding
NeurIPS 2025
·
Chuofan Ma
DBLP profile ↗
ORCID search ↗
EVE: Efficient Vision-Language Pre-training with Masked Prediction and Modality-Aware MoE
AAAI 2024
·
Junyi Chen
DBLP profile ↗
ORCID search ↗
General Object Foundation Model for Images and Videos at Scale
CVPR 2024
·
Junfeng Wu
DBLP profile ↗
ORCID search ↗
Generative Region-Language Pretraining for Open-Ended Object Detection
CVPR 2024
·
Chuang Lin
DBLP profile ↗
ORCID search ↗
Groma: Localized Visual Tokenization for Grounding Multimodal Large Language Models
ECCV 2024
·
Chuofan Ma
DBLP profile ↗
ORCID search ↗
MotionMAE: Self-supervised Video Representation Learning with Motion-Aware Masked Autoencoders
BMVC 2024
·
Haosen Yang
DBLP profile ↗
ORCID search ↗
OmniTokenizer: A Joint Image-Video Tokenizer for Visual Generation
NeurIPS 2024
·
Junke Wang
DBLP profile ↗
ORCID search ↗
Recognize Any Regions
NeurIPS 2024
·
Haosen Yang
DBLP profile ↗
ORCID search ↗
Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction
NeurIPS 2024
·
Keyu Tian
DBLP profile ↗
ORCID search ↗