P
PaperPicks
Conferences
Tong He
Shanghai AI Lab, Shanghai
31 papers at tracked venues · 26 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID 0000-0003-2772-9320 ↗
Google Scholar ↗
Homepage ↗
Venues
ICLR
×7
CVPR
×6
NeurIPS
×6
ECCV
×5
AAAI
×3
ICCV
×3
ACL
×1
Frequent coauthors
Haoyi Zhu
DBLP profile ↗
ORCID search ↗
×3
Honghui Yang
DBLP profile ↗
ORCID search ↗
×2
Junyi Chen
DBLP profile ↗
ORCID search ↗
×2
Canyu Zhao
DBLP profile ↗
ORCID search ↗
×1
Lu Chen
DBLP profile ↗
ORCID search ↗
×1
Zebin Xing
DBLP profile ↗
ORCID search ↗
×1
Peng Gao
DBLP profile ↗
ORCID search ↗
×1
Yiwen Chen
DBLP profile ↗
ORCID search ↗
×1
Ziyu Tang
DBLP profile ↗
ORCID search ↗
×1
Zhen Li
DBLP profile ↗
ORCID search ↗
×1
Jiange Yang
DBLP profile ↗
ORCID search ↗
×1
Yating Wang
DBLP profile ↗
ORCID search ↗
×1
Papers
AETHER: Geometric-Aware Unified World Modeling
ICCV 2025
·
Haoyi Zhu
DBLP profile ↗
ORCID search ↗
DICEPTION: A Generalist Diffusion Model for Visual Perceptual Tasks
NeurIPS 2025
·
Canyu Zhao
DBLP profile ↗
ORCID search ↗
Depth Any Video with Scalable Synthetic Data
ICLR 2025
·
Honghui Yang
DBLP profile ↗
ORCID search ↗
EgoAgent: A Joint Predictive Agent Model in Egocentric Worlds
ICCV 2025
·
Lu Chen
DBLP profile ↗
ORCID search ↗
GigaGS: 3D Gaussian Based Planar Representation for Large-Scene Surface Reconstruction
AAAI 2025
·
Junyi Chen
DBLP profile ↗
ORCID search ↗
GoalFlow: Goal-Driven Flow Matching for Multimodal Trajectories Generation in End-to-End Autonomous Driving
CVPR 2025
·
Zebin Xing
DBLP profile ↗
ORCID search ↗
Lumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation
ICLR 2025
·
Peng Gao
DBLP profile ↗
ORCID search ↗
MeshAnything: Artist-Created Mesh Generation with Autoregressive Transformers
ICLR 2025
·
Yiwen Chen
DBLP profile ↗
ORCID search ↗
ND-SDF: Learning Normal Deflection Fields for High-Fidelity Indoor Reconstruction
ICLR 2025
·
Ziyu Tang
DBLP profile ↗
ORCID search ↗
SPA: 3D Spatial-Awareness Enables Effective Embodied Representation
ICLR 2025
·
Haoyi Zhu
DBLP profile ↗
ORCID search ↗
Sekai: A Video Dataset towards World Exploration
NeurIPS 2025
·
Zhen Li
DBLP profile ↗
ORCID search ↗
Tra-MoE: Learning Trajectory Prediction Model from Multiple Domains for Adaptive Policy Conditioning
CVPR 2025
·
Jiange Yang
DBLP profile ↗
ORCID search ↗
VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers
ICCV 2025
·
Yating Wang
DBLP profile ↗
ORCID search ↗
Where Am I and What Will I See: An Auto-Regressive Model for Spatial Localization and View Prediction
ICLR 2025
·
Junyi Chen
DBLP profile ↗
ORCID search ↗
Agent3D-Zero: An Agent for Zero-Shot 3D Understanding
ECCV 2024
·
Sha Zhang
DBLP profile ↗
ORCID search ↗
Boosting Residual Networks with Group Knowledge
AAAI 2024
·
Shengji Tang
DBLP profile ↗
ORCID search ↗
CaMML: Context-Aware Multimodal Learner for Large Models
ACL 2024
·
Yixin Chen
DBLP profile ↗
ORCID search ↗
Convolution Meets LoRA: Parameter Efficient Finetuning for Segment Anything Model
ICLR 2024
·
Zihan Zhong
DBLP profile ↗
ORCID search ↗
DetToolChain: A New Prompting Paradigm to Unleash Detection Ability of MLLM
ECCV 2024
·
Yixuan Wu
DBLP profile ↗
ORCID search ↗
DiffPano: Scalable and Consistent Text to Panorama Generation with Spherical Epipolar-Aware Diffusion
NeurIPS 2024
·
Weicai Ye
DBLP profile ↗
ORCID search ↗
DreamComposer: Controllable 3D Object Generation via Multi-View Conditions
CVPR 2024
·
Yunhan Yang
DBLP profile ↗
ORCID search ↗
EMR-Merging: Tuning-Free High-Performance Model Merging
NeurIPS 2024
·
Chenyu Huang
DBLP profile ↗
ORCID search ↗
Frozen CLIP Transformer Is an Efficient Point Cloud Encoder
AAAI 2024
·
Xiaoshui Huang
DBLP profile ↗
ORCID search ↗
GVGEN: Text-to-3D Generation with Volumetric Representation
ECCV 2024
·
Xianglong He
DBLP profile ↗
ORCID search ↗
NeuRodin: A Two-stage Framework for High-Fidelity Neural Surface Reconstruction
NeurIPS 2024
·
Yifan Wang
DBLP profile ↗
ORCID search ↗
Pixel-GS: Density Control with Pixel-Aware Gradient for 3D Gaussian Splatting
ECCV 2024
·
Zheng Zhang
DBLP profile ↗
ORCID search ↗
Point Cloud Matters: Rethinking the Impact of Different Observation Spaces on Robot Learning
NeurIPS 2024
·
Haoyi Zhu
DBLP profile ↗
ORCID search ↗
Point Transformer V3: Simpler, Faster, Stronger
CVPR 2024
·
Xiaoyang Wu
DBLP profile ↗
ORCID search ↗
PredBench: Benchmarking Spatio-Temporal Prediction Across Diverse Disciplines
ECCV 2024
·
Zidong Wang
DBLP profile ↗
ORCID search ↗
TASeg: Temporal Aggregation Network for LiDAR Semantic Segmentation
CVPR 2024
·
Xiaopei Wu
DBLP profile ↗
ORCID search ↗
UniPAD: A Universal Pre-Training Paradigm for Autonomous Driving
CVPR 2024
·
Honghui Yang
DBLP profile ↗
ORCID search ↗