P
PaperPicks
Conferences
Yu Liu
Sensetime Group Ltd., Beijing, China
28 papers at tracked venues · 21 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID 0000-0001-5812-1137 ↗
Google Scholar ↗
Homepage ↗
Venues
CVPR
×7
NeurIPS
×7
ECCV
×6
AAAI
×2
ICLR
×2
ICML
×2
ICCV
×1
ICRA
×1
Frequent coauthors
Hao Shao
DBLP profile ↗
ORCID search ↗
×3
Fu-Yun Wang
DBLP profile ↗
ORCID search ↗
×3
Zhuofan Zong
DBLP profile ↗
ORCID search ↗
×2
Dongzhi Jiang
DBLP profile ↗
ORCID search ↗
×2
Jianxiong Li
DBLP profile ↗
ORCID search ↗
×2
Yang Zhou
DBLP profile ↗
ORCID search ↗
×2
Jinliang Zheng
DBLP profile ↗
ORCID search ↗
×2
Rongkun Xue
DBLP profile ↗
ORCID search ↗
×1
Yunpeng Liu
DBLP profile ↗
ORCID search ↗
×1
Yinmin Zhang
DBLP profile ↗
ORCID search ↗
×1
Yuanfu Wang
DBLP profile ↗
ORCID search ↗
×1
Xiaoshi Wu
DBLP profile ↗
ORCID search ↗
×1
Papers
EasyRef: Omni-Generalized Group Image Reference for Diffusion Models via Multimodal LLM
ICML 2025
·
Zhuofan Zong
DBLP profile ↗
ORCID search ↗
MMSearch: Unveiling the Potential of Large Models as Multi-modal Search Engines
ICLR 2025
·
Dongzhi Jiang
DBLP profile ↗
ORCID search ↗
Pretrained Reversible Generation as Unsupervised Visual Representation Learning
ICCV 2025
·
Rongkun Xue
DBLP profile ↗
ORCID search ↗
Robo-MUTUAL: Robotic Multimodal Task Specification via Unimodal Learning
ICRA 2025
·
Jianxiong Li
DBLP profile ↗
ORCID search ↗
See Further When Clear: Curriculum Consistency Model
CVPR 2025
·
Yunpeng Liu
DBLP profile ↗
ORCID search ↗
SmartPretrain: Model-Agnostic and Dataset-Agnostic Representation Learning for Motion Prediction
ICLR 2025
·
Yang Zhou
DBLP profile ↗
ORCID search ↗
Universal Actions for Enhanced Embodied Foundation Models
CVPR 2025
·
Jinliang Zheng
DBLP profile ↗
ORCID search ↗
VividFace: A Robost and High-Fidelity Video Face Swapping Framework
NeurIPS 2025
·
Hao Shao
DBLP profile ↗
ORCID search ↗
A Perspective of Q-value Estimation on Offline-to-Online Reinforcement Learning
AAAI 2024
·
Yinmin Zhang
DBLP profile ↗
ORCID search ↗
Be-Your-Outpainter: Mastering Video Outpainting Through Input-Specific Adaptation
ECCV 2024
·
Fu-Yun Wang
DBLP profile ↗
ORCID search ↗
CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching
NeurIPS 2024
·
Dongzhi Jiang
DBLP profile ↗
ORCID search ↗
Critic-Guided Decision Transformer for Offline Reinforcement Learning
AAAI 2024
·
Yuanfu Wang
DBLP profile ↗
ORCID search ↗
DecisionNCE: Embodied Multimodal Representations via Implicit Preference Learning
ICML 2024
·
Jianxiong Li
DBLP profile ↗
ORCID search ↗
Deep Reward Supervisions for Tuning Text-to-Image Diffusion Models
ECCV 2024
·
Xiaoshi Wu
DBLP profile ↗
ORCID search ↗
EasyDrag: Efficient Point-Based Manipulation on Diffusion Models
CVPR 2024
·
Xingzhong Hou
DBLP profile ↗
ORCID search ↗
Exploring the Role of Large Language Models in Prompt Encoding for Diffusion Models
NeurIPS 2024
·
Bingqi Ma
DBLP profile ↗
ORCID search ↗
FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis
ECCV 2024
·
Linjiang Huang
DBLP profile ↗
ORCID search ↗
GLID: Pre-training a Generalist Encoder-Decoder Vision Model
CVPR 2024
·
Jihao Liu
DBLP profile ↗
ORCID search ↗
GPT4RoI: Instruction Tuning Large Language Model on Region-of-Interest
ECCV 2024
·
Shilong Zhang
DBLP profile ↗
ORCID search ↗
Instruction-Guided Visual Masking
NeurIPS 2024
·
Jinliang Zheng
DBLP profile ↗
ORCID search ↗
LMDrive: Closed-Loop End-to-End Driving with Large Language Models
CVPR 2024
·
Hao Shao
DBLP profile ↗
ORCID search ↗
MoVA: Adapting Mixture of Vision Experts to Multimodal Context
NeurIPS 2024
·
Zhuofan Zong
DBLP profile ↗
ORCID search ↗
Phased Consistency Models
NeurIPS 2024
·
Fu-Yun Wang
DBLP profile ↗
ORCID search ↗
Rethinking the Spatial Inconsistency in Classifier-Free Diffusion Guidance
CVPR 2024
·
Dazhong Shen
DBLP profile ↗
ORCID search ↗
SmartRefine: A Scenario-Adaptive Refinement Framework for Efficient Motion Prediction
CVPR 2024
·
Yang Zhou
DBLP profile ↗
ORCID search ↗
Three Things We Need to Know About Transferring Stable Diffusion to Visual Dense Prediction Tasks
ECCV 2024
·
Manyuan Zhang
DBLP profile ↗
ORCID search ↗
Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning
NeurIPS 2024
·
Hao Shao
DBLP profile ↗
ORCID search ↗
ZoLA: Zero-Shot Creative Long Animation Generation with Short Video Model
ECCV 2024
·
Fu-Yun Wang
DBLP profile ↗
ORCID search ↗