P
PaperPicks
Conferences
Xinggang Wang
38 papers at tracked venues · 30 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0001-6732-7823 ↗
Homepage ↗
Venues
AAAI
×9
CVPR
×9
ECCV
×7
NeurIPS
×4
ACM MM
×2
ICCV
×2
ICLR
×2
ECAI
×1
ICML
×1
WWW
×1
Frequent coauthors
Lianghui Zhu
DBLP profile ↗
ORCID search ↗
×5
Bencheng Liao
DBLP profile ↗
ORCID search ↗
×3
Haijun Xiong
DBLP profile ↗
ORCID search ↗
×2
Ke Ma
DBLP profile ↗
ORCID search ↗
×2
Ziyang Xu
DBLP profile ↗
ORCID search ↗
×2
Haoyi Jiang
DBLP profile ↗
ORCID search ↗
×2
Jingfeng Yao
DBLP profile ↗
ORCID search ↗
×2
Zanwei Zhou
DBLP profile ↗
ORCID search ↗
×1
Wenrui Zhang
DBLP profile ↗
ORCID search ↗
×1
Ya Zou
DBLP profile ↗
ORCID search ↗
×1
Zongming Li
DBLP profile ↗
ORCID search ↗
×1
Shuai Zhang
DBLP profile ↗
ORCID search ↗
×1
Papers
Few-step Flow for 3D Generation via Marginal-Data Transport Distillation
AAAI 2026
·
Zanwei Zhou
DBLP profile ↗
ORCID search ↗
Gait Recognition via Collaborating Discriminative and Generative Diffusion Models
AAAI 2026
·
Haijun Xiong
DBLP profile ↗
ORCID search ↗
LENS: Learning to Segment Anything with Unified Reinforced Reasoning
AAAI 2026
·
Lianghui Zhu
DBLP profile ↗
ORCID search ↗
MolSight: Optical Chemical Structure Recognition with SMILES Pretraining, Multi-Granularity Learning and Reinforcement Learning
AAAI 2026
·
Wenrui Zhang
DBLP profile ↗
ORCID search ↗
Phys-Liquid: A Physics-Informed Dataset for Estimating 3D Geometry and Volume of Transparent Deformable Liquids
AAAI 2026
·
Ke Ma
DBLP profile ↗
ORCID search ↗
Turbo-VAED: Fast and Stable Transfer of Video-VAEs to Mobile Devices
AAAI 2026
·
Ya Zou
DBLP profile ↗
ORCID search ↗
WPIS: From In-the-Wild Web Images to Physics-Aware 3D Scene Graphs for Physical Reasoning
WWW 2026
·
Ke Ma
DBLP profile ↗
ORCID search ↗
ControlAR: Controllable Image Generation with Autoregressive Models
ICLR 2025
·
Zongming Li
DBLP profile ↗
ORCID search ↗
DiG: Scalable and Efficient Diffusion Models with Gated Linear Attention
CVPR 2025
·
Lianghui Zhu
DBLP profile ↗
ORCID search ↗
DiffusionDrive: Truncated Diffusion Model for End-to-End Autonomous Driving
CVPR 2025
·
Bencheng Liao
DBLP profile ↗
ORCID search ↗
Dynamic 2D Gaussians: Geometrically Accurate Radiance Fields for Dynamic Objects
ACM MM 2025
·
Shuai Zhang
DBLP profile ↗
ORCID search ↗
GaraMoSt: Parallel Multi-Granularity Motion and Structural Modeling for Efficient Multi-Frame Interpolation in DSA Images
AAAI 2025
·
Ziyang Xu
DBLP profile ↗
ORCID search ↗
GaussTR: Foundation Model-Aligned Gaussian Transformer for Self-Supervised 3D Spatial Understanding
CVPR 2025
·
Haoyi Jiang
DBLP profile ↗
ORCID search ↗
Genesis: Multimodal Driving Scene Generation with Spatio-Temporal and Cross-Modal Consistency
NeurIPS 2025
·
Xiangyu Guo
DBLP profile ↗
ORCID search ↗
GroundingSuite: Measuring Complex Multi-Granular Pixel Grounding
ICCV 2025
·
Rui Hu
DBLP profile ↗
ORCID search ↗
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
ICLR 2025
·
Lianghui Zhu
DBLP profile ↗
ORCID search ↗
MaTVLM: Hybrid Mamba-Transformer for Efficient Vision-Language Modeling
ICCV 2025
·
Yingyue Li
DBLP profile ↗
ORCID search ↗
Mask-Adapter: The Devil is in the Masks for Open-Vocabulary Segmentation
CVPR 2025
·
Yongkang Li
DBLP profile ↗
ORCID search ↗
RAD: Training an End-to-End Driving Policy via Large-Scale 3DGS-based Reinforcement Learning
NeurIPS 2025
·
Hao Gao
DBLP profile ↗
ORCID search ↗
Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models
CVPR 2025
·
Jingfeng Yao
DBLP profile ↗
ORCID search ↗
SuperCLIP: CLIP with Simple Classification Supervision
NeurIPS 2025
·
Weiheng Zhao
DBLP profile ↗
ORCID search ↗
ViG: Linear-complexity Visual Sequence Learning with Gated Linear Attention
AAAI 2025
·
Bencheng Liao
DBLP profile ↗
ORCID search ↗
4D Gaussian Splatting for Real-Time Dynamic Scene Rendering
CVPR 2024
·
Guanjun Wu
DBLP profile ↗
ORCID search ↗
Cascade-Zero123: One Image to Highly Consistent 3D with Self-prompted Nearby Views
ECCV 2024
·
Yabo Chen
DBLP profile ↗
ORCID search ↗
Causality-Inspired Discriminative Feature Learning in Triple Domains for Gait Recognition
ECCV 2024
·
Haijun Xiong
DBLP profile ↗
ORCID search ↗
Co-Student: Collaborating Strong and Weak Students for Sparsely Annotated Object Detection
ECCV 2024
·
Lianjun Wu
DBLP profile ↗
ORCID search ↗
FasterDiT: Towards Faster Diffusion Transformers Training without Architecture Modification
NeurIPS 2024
·
Jingfeng Yao
DBLP profile ↗
ORCID search ↗
GaussianDreamer: Fast Generation from Text to 3D Gaussians by Bridging 2D and 3D Diffusion Models
CVPR 2024
·
Taoran Yi
DBLP profile ↗
ORCID search ↗
Lane Graph as Path: Continuity-Preserving Path-Wise Modeling for Online Lane Graph Construction
ECCV 2024
·
Bencheng Liao
DBLP profile ↗
ORCID search ↗
MoSt-DSA: Modeling Motion and Structural Interactions for Direct Multi-Frame Interpolation in DSA Images
ECAI 2024
·
Ziyang Xu
DBLP profile ↗
ORCID search ↗
MobileInst: Video Instance Segmentation on the Mobile
AAAI 2024
·
Renhong Zhang
DBLP profile ↗
ORCID search ↗
Occupancy as Set of Points
ECCV 2024
·
Yiang Shi
DBLP profile ↗
ORCID search ↗
Symphonize 3D Semantic Scene Completion with Contextual Instance Queries
CVPR 2024
·
Haoyi Jiang
DBLP profile ↗
ORCID search ↗
Towards Dual Transparent Liquid Level Estimation in Biomedical Lab: Dataset, Methods and Practices
ECCV 2024
·
Xiayu Wang
DBLP profile ↗
ORCID search ↗
Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model
ICML 2024
·
Lianghui Zhu
DBLP profile ↗
ORCID search ↗
Visual Text Generation in the Wild
ECCV 2024
·
Yuanzhi Zhu
DBLP profile ↗
ORCID search ↗
WeakSAM: Segment Anything Meets Weakly-supervised Instance-level Recognition
ACM MM 2024
·
Lianghui Zhu
DBLP profile ↗
ORCID search ↗
YOLO-World: Real-Time Open-Vocabulary Object Detection
CVPR 2024
·
Tianheng Cheng
DBLP profile ↗
ORCID search ↗