P
PaperPicks
Conferences
Zhengkai Jiang
Tencent, Youtu Lab, Shanghai, China
16 papers at tracked venues · 10 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID 0000-0003-4064-994X ↗
Google Scholar ↗
Homepage ↗
Venues
ACM MM
×2
CVPR
×2
ECCV
×2
ICLR
×2
IROS
×2
NeurIPS
×2
AAAI
×1
ICCV
×1
ICRA
×1
IJCAI
×1
Frequent coauthors
Siyuan Huang
DBLP profile ↗
ORCID search ↗
×2
Xiaofeng Mao
DBLP profile ↗
ORCID search ↗
×2
Qingdong He
DBLP profile ↗
ORCID search ↗
×2
Yiyang Cai
DBLP profile ↗
ORCID search ↗
×1
Peng Gao
DBLP profile ↗
ORCID search ↗
×1
Xin Li
DBLP profile ↗
ORCID search ↗
×1
Qiaojun Yu
DBLP profile ↗
ORCID search ↗
×1
Shizhan Liu
DBLP profile ↗
ORCID search ↗
×1
Xiaobin Hu
DBLP profile ↗
ORCID search ↗
×1
Liren He
DBLP profile ↗
ORCID search ↗
×1
Chencan Fu
DBLP profile ↗
ORCID search ↗
×1
Renrui Zhang
DBLP profile ↗
ORCID search ↗
×1
Papers
EnerVerse: Envisioning Embodied Future Space for Robotics Manipulation
NeurIPS 2025
·
Siyuan Huang
DBLP profile ↗
ORCID search ↗
Foundation Cures Personalization: Improving Personalized Models' Prompt Consistency via Hidden Foundation Knowledge
NeurIPS 2025
·
Yiyang Cai
DBLP profile ↗
ORCID search ↗
Lumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation
ICLR 2025
·
Peng Gao
DBLP profile ↗
ORCID search ↗
OSV: One Step is Enough for High-Quality Image to Video Generation
CVPR 2025
·
Xiaofeng Mao
DBLP profile ↗
ORCID search ↗
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
ICCV 2025
·
Qingdong He
DBLP profile ↗
ORCID search ↗
SKT: Integrating State-Aware Keypoint Trajectories with Vision-Language Models for Robotic Garment Manipulation
IROS 2025
·
Xin Li
DBLP profile ↗
ORCID search ↗
UniAff: A Unified Representation of Affordances for Tool Usage and Articulation with Vision-Language Models
ICRA 2025
·
Qiaojun Yu
DBLP profile ↗
ORCID search ↗
Density Matters: Improved Core-Set for Active Domain Adaptive Segmentation
AAAI 2024
·
Shizhan Liu
DBLP profile ↗
ORCID search ↗
DiffuMatting: Synthesizing Arbitrary Objects with Matting-Level Annotation
ECCV 2024
·
Xiaobin Hu
DBLP profile ↗
ORCID search ↗
Learning Unified Reference Representation for Unsupervised Multi-class Anomaly Detection
ECCV 2024
·
Liren He
DBLP profile ↗
ORCID search ↗
MDT-A2G: Exploring Masked Diffusion Transformers for Co-Speech Gesture Generation
ACM MM 2024
·
Xiaofeng Mao
DBLP profile ↗
ORCID search ↗
MambaGesture: Enhancing Co-Speech Gesture Generation with Mamba and Disentangled Multi-Modality Fusion
ACM MM 2024
·
Chencan Fu
DBLP profile ↗
ORCID search ↗
ManipVQA: Injecting Robotic Affordance and Physically Grounded Information into Multi-Modal Large Language Models
IROS 2024
·
Siyuan Huang
DBLP profile ↗
ORCID search ↗
Personalize Segment Anything Model with One Shot
ICLR 2024
·
Renrui Zhang
DBLP profile ↗
ORCID search ↗
SDSTrack: Self-Distillation Symmetric Adapter Learning for Multi-Modal Visual Object Tracking
CVPR 2024
·
Xiaojun Hou
DBLP profile ↗
ORCID search ↗
UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation
IJCAI 2024
·
Qingdong He
DBLP profile ↗
ORCID search ↗