P
PaperPicks
Conferences
Hanwang Zhang
61 papers at tracked venues · 56 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0001-7374-8739 ↗
Homepage ↗
Venues
CVPR
×15
NeurIPS
×13
AAAI
×10
ICML
×7
ICCV
×5
ECCV
×4
ACM MM
×3
ICLR
×3
WACV
×1
Frequent coauthors
Xingyu Zhu
DBLP profile ↗
ORCID search ↗
×5
Hao Fei
DBLP profile ↗
ORCID search ↗
×5
Qingshan Xu
DBLP profile ↗
ORCID search ↗
×3
Yuxuan Wang
DBLP profile ↗
ORCID search ↗
×3
Beier Zhu
DBLP profile ↗
ORCID search ↗
×3
Kaihang Pan
DBLP profile ↗
ORCID search ↗
×3
Wang Lin
DBLP profile ↗
ORCID search ↗
×3
Yuan Zhou
DBLP profile ↗
ORCID search ↗
×2
Xue Song
DBLP profile ↗
ORCID search ↗
×2
Jingjing Jiang
DBLP profile ↗
ORCID search ↗
×2
Shengqiong Wu
DBLP profile ↗
ORCID search ↗
×2
Jiequan Cui
DBLP profile ↗
ORCID search ↗
×2
Papers
DEPO: Dual-Efficiency Preference Optimization for LLM Agents
AAAI 2026
·
Sirui Chen
DBLP profile ↗
ORCID search ↗
DragNeXt: Rethinking Drag-Based Image Editing
AAAI 2026
·
Yuan Zhou
DBLP profile ↗
ORCID search ↗
Hierarchical Semantic Alignment for Image Clustering
AAAI 2026
·
Xingyu Zhu
DBLP profile ↗
ORCID search ↗
Learning to Animate Images from A Few Videos to Portray Delicate Human Actions
WACV 2026
·
Haoxin Li
DBLP profile ↗
ORCID search ↗
NeuSpring: Neural Spring Fields for Reconstruction and Simulation of Deformable Objects from Videos
AAAI 2026
·
Qingshan Xu
DBLP profile ↗
ORCID search ↗
Object Fusion via Diffusion Time-step for Customized Image Editing with Single Example
AAAI 2026
·
Xue Song
DBLP profile ↗
ORCID search ↗
Personalize Your Gaussian: Consistent 3D Scene Personalization from a Single Image
AAAI 2026
·
Yuxuan Wang
DBLP profile ↗
ORCID search ↗
Pushing Rendering Boundaries: Hard Gaussian Splatting
AAAI 2026
·
Qingshan Xu
DBLP profile ↗
ORCID search ↗
3D Question Answering via only 2D Vision-Language Models
ICML 2025
·
Fengyun Wang
DBLP profile ↗
ORCID search ↗
A Closer Look at Time Steps is Worthy of Triple Speed-Up for Diffusion Model Training
CVPR 2025
·
Kai Wang
DBLP profile ↗
ORCID search ↗
AnyEdit: Mastering Unified High-Quality Image Editing for Any Idea
CVPR 2025
·
Qifan Yu
DBLP profile ↗
ORCID search ↗
CARE Transformer: Mobile-Friendly Linear Visual Transformer via Decoupled Dual Interaction
CVPR 2025
·
Yuan Zhou
DBLP profile ↗
ORCID search ↗
Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing
ICML 2025
·
Kaifeng Gao
DBLP profile ↗
ORCID search ↗
Co-Reinforcement Learning for Unified Multimodal Understanding and Generation
NeurIPS 2025
·
Jingjing Jiang
DBLP profile ↗
ORCID search ↗
Corvid: Improving Multimodal Large Language Models Towards Chain-of-Thought Reasoning
ICCV 2025
·
Jingjing Jiang
DBLP profile ↗
ORCID search ↗
Distilling Parallel Gradients for Fast ODE Solvers of Diffusion Models
ICCV 2025
·
Beier Zhu
DBLP profile ↗
ORCID search ↗
Dynamic Multimodal Prototype Learning in Vision-Language Models
ICCV 2025
·
Xingyu Zhu
DBLP profile ↗
ORCID search ↗
Enhancing CLIP Robustness via Cross-Modality Alignment
NeurIPS 2025
·
Xingyu Zhu
DBLP profile ↗
ORCID search ↗
Generative Multimodal Pretraining with Discrete Diffusion Timestep Tokens
CVPR 2025
·
Kaihang Pan
DBLP profile ↗
ORCID search ↗
Large Generative Models Meet Multimodal Applications (LGM3A)
ACM MM 2025
·
Zheng Wang
DBLP profile ↗
ORCID search ↗
Learning 4D Panoptic Scene Graph Generation from Rich 2D Visual Scene
CVPR 2025
·
Shengqiong Wu
DBLP profile ↗
ORCID search ↗
Nautilus: Locality-Aware Autoencoder for Scalable Mesh Generation
ICCV 2025
·
Yuxuan Wang
DBLP profile ↗
ORCID search ↗
On Path to Multimodal Generalist: General-Level and General-Bench
ICML 2025
·
Hao Fei
DBLP profile ↗
ORCID search ↗
Project-Probe-Aggregate: Efficient Fine-Tuning for Group Robustness
CVPR 2025
·
Beier Zhu
DBLP profile ↗
ORCID search ↗
SGDiff: Scene Graph Guided Diffusion Model for Image Collaborative SegCaptioning
AAAI 2025
·
Xu Zhang
DBLP profile ↗
ORCID search ↗
Selftok-Zero: Reinforcement Learning for Visual Generation via Discrete and Autoregressive Visual Tokens
NeurIPS 2025
·
Bohan Wang
DBLP profile ↗
ORCID search ↗
Towards Semantic Equivalence of Tokenization in Multimodal LLM
ICLR 2025
·
Shengqiong Wu
DBLP profile ↗
ORCID search ↗
Unsupervised Visual Chain-of-Thought Reasoning via Preference Optimization
ICCV 2025
·
Kesen Zhao
DBLP profile ↗
ORCID search ↗
Vinci: Deep Thinking in Text-to-Image Generation using Unified Model with Reinforcement Learning
NeurIPS 2025
·
Wang Lin
DBLP profile ↗
ORCID search ↗
VistaDPO: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video Models
ICML 2025
·
Haojian Huang
DBLP profile ↗
ORCID search ↗
Action Imitation in Common Action Space for Customized Action Image Synthesis
NeurIPS 2024
·
Wang Lin
DBLP profile ↗
ORCID search ↗
Auto-Encoding Morph-Tokens for Multimodal LLM
ICML 2024
·
Kaihang Pan
DBLP profile ↗
ORCID search ↗
Classes Are Not Equal: An Empirical Study on Image Recognition Fairness
CVPR 2024
·
Jiequan Cui
DBLP profile ↗
ORCID search ↗
Consistent3D: Towards Consistent High-Fidelity Text-to-3D Generation with Deterministic Sampling Prior
CVPR 2024
·
Zike Wu
DBLP profile ↗
ORCID search ↗
Decoupled Kullback-Leibler Divergence Loss
NeurIPS 2024
·
Jiequan Cui
DBLP profile ↗
ORCID search ↗
Diffusion Time-step Curriculum for One Image to 3D Generation
CVPR 2024
·
Xuanyu Yi
DBLP profile ↗
ORCID search ↗
Disco: Disentangled Control for Realistic Human Dance Generation
CVPR 2024
·
Tan Wang
DBLP profile ↗
ORCID search ↗
Discriminative Probing and Tuning for Text-to-Image Generation
CVPR 2024
·
Leigang Qu
DBLP profile ↗
ORCID search ↗
Distributionally Generative Augmentation for Fair Facial Attribute Classification
CVPR 2024
·
Fengda Zhang
DBLP profile ↗
ORCID search ↗
Doubly Abductive Counterfactual Inference for Text-Based Image Editing
CVPR 2024
·
Xue Song
DBLP profile ↗
ORCID search ↗
Dual-Perspective Knowledge Enrichment for Semi-supervised 3D Object Detection
AAAI 2024
·
Yucheng Han
DBLP profile ↗
ORCID search ↗
Dysen-VDM: Empowering Dynamics-Aware Text-to-Video Diffusion with LLMs
CVPR 2024
·
Hao Fei
DBLP profile ↗
ORCID search ↗
Enhancing Zero-Shot Vision Models by Label-Free Prompt Distribution Learning and Bias Correcting
NeurIPS 2024
·
Xingyu Zhu
DBLP profile ↗
ORCID search ↗
Exploring Diffusion Time-steps for Unsupervised Representation Learning
ICLR 2024
·
Zhongqi Yue
DBLP profile ↗
ORCID search ↗
Few-Shot Learner Parameterization by Diffusion Time-Steps
CVPR 2024
·
Zhongqi Yue
DBLP profile ↗
ORCID search ↗
Few-Shot NeRF by Adaptive Rendering Loss Regularization
ECCV 2024
·
Qingshan Xu
DBLP profile ↗
ORCID search ↗
Fine-tuning Multimodal LLMs to Follow Zero-shot Demonstrative Instructions
ICLR 2024
·
Juncheng Li
DBLP profile ↗
ORCID search ↗
From Multimodal LLM to Human-level AI: Modality, Instruction, Reasoning and Beyond
ACM MM 2024
·
Hao Fei
DBLP profile ↗
ORCID search ↗
Instruction Tuning-Free Visual Token Complement for Multimodal LLMs
ECCV 2024
·
Dongsheng Wang
DBLP profile ↗
ORCID search ↗
Lever LM: Configuring In-Context Sequence to Lever Large Vision Language Models
NeurIPS 2024
·
Xu Yang
DBLP profile ↗
ORCID search ↗
MGNet: Learning Correspondences via Multiple Graphs
AAAI 2024
·
Luanyuan Dai
DBLP profile ↗
ORCID search ↗
MVGamba: Unify 3D Content Generation as State Space Sequence Modeling
NeurIPS 2024
·
Xuanyu Yi
DBLP profile ↗
ORCID search ↗
Non-confusing Generation of Customized Concepts in Diffusion Models
ICML 2024
·
Wang Lin
DBLP profile ↗
ORCID search ↗
Rethinking and Improving Visual Prompt Selection for In-Context Learning Segmentation
ECCV 2024
·
Wei Suo
DBLP profile ↗
ORCID search ↗
Robust Fine-tuning of Zero-shot Models via Variance Reduction
NeurIPS 2024
·
Beier Zhu
DBLP profile ↗
ORCID search ↗
Selective Vision-Language Subspace Projection for Few-shot CLIP
ACM MM 2024
·
Xingyu Zhu
DBLP profile ↗
ORCID search ↗
Towards Unified Multimodal Editing with Enhanced Knowledge Collaboration
NeurIPS 2024
·
Kaihang Pan
DBLP profile ↗
ORCID search ↗
Unified Generative and Discriminative Training for Multi-modal Large Language Models
NeurIPS 2024
·
Wei Chow
DBLP profile ↗
ORCID search ↗
Video-of-Thought: Step-by-Step Video Reasoning from Perception to Cognition
ICML 2024
·
Hao Fei
DBLP profile ↗
ORCID search ↗
View-Consistent 3D Editing with Gaussian Splatting
ECCV 2024
·
Yuxuan Wang
DBLP profile ↗
ORCID search ↗
Vitron: A Unified Pixel-level Vision LLM for Understanding, Generating, Segmenting, Editing
NeurIPS 2024
·
Hao Fei
DBLP profile ↗
ORCID search ↗