P
PaperPicks
Conferences
Xiaodan Liang
70 papers at tracked venues · 55 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×11
NeurIPS
×11
ICLR
×10
CVPR
×8
ACL
×6
ECCV
×5
ACM MM
×4
ICCV
×4
NAACL
×3
EMNLP
×2
WACV
×2
CIKM
×1
ICML
×1
ICRA
×1
IROS
×1
Frequent coauthors
Rongtao Xu
DBLP profile ↗
ORCID search ↗
×3
Jiaqi Chen
DBLP profile ↗
ORCID search ↗
×3
Tao Tang
DBLP profile ↗
ORCID search ↗
×3
Tang Tao
DBLP profile ↗
ORCID search ↗
×3
Meng Cao
DBLP profile ↗
ORCID search ↗
×2
Haoran Tang
DBLP profile ↗
ORCID search ↗
×2
Youpeng Wen
DBLP profile ↗
ORCID search ↗
×2
Runhui Huang
DBLP profile ↗
ORCID search ↗
×2
Zhicheng Yang
DBLP profile ↗
ORCID search ↗
×2
Jing Wang
DBLP profile ↗
ORCID search ↗
×2
Kaidong Zhang
DBLP profile ↗
ORCID search ↗
×2
Zhijian Huang
DBLP profile ↗
ORCID search ↗
×2
Papers
Video SimpleQA: Towards Factuality Evaluation in Large Video Language Models
AAAI 2026
·
Meng Cao
DBLP profile ↗
ORCID search ↗
Video Spatial Reasoning with Object-Centric 3D Rollout
AAAI 2026
·
Haoran Tang
DBLP profile ↗
ORCID search ↗
X-SAM: From Segment Anything to Any Segmentation
AAAI 2026
·
Hao Wang
DBLP profile ↗
ORCID search ↗
$A_{0}$: An Affordance-Aware Hierarchical Model for General Robotic Manipulation
ICCV 2025
·
Rongtao Xu
DBLP profile ↗
ORCID search ↗
3D-MoRe: Unified Modal-Contextual Reasoning for Embodied Question Answering
IROS 2025
·
Rongtao Xu
DBLP profile ↗
ORCID search ↗
Affordances-Oriented Planning Using Foundation Models for Continuous Vision-Language Navigation
AAAI 2025
·
Jiaqi Chen
DBLP profile ↗
ORCID search ↗
BEV-TSR: Text-Scene Retrieval in BEV Space for Autonomous Driving
AAAI 2025
·
Tao Tang
DBLP profile ↗
ORCID search ↗
CatVTON: Concatenation Is All You Need for Virtual Try-On with Diffusion Models
ICLR 2025
·
Zheng Chong
DBLP profile ↗
ORCID search ↗
Complementary Information Guided Occupancy Prediction via Multi-Level Representation Fusion
ICRA 2025
·
Rongtao Xu
DBLP profile ↗
ORCID search ↗
DialogGen: Multi-modal Interactive Dialogue System with Multi-turn Text-Image Generation
NAACL 2025
·
Minbin Huang
DBLP profile ↗
ORCID search ↗
DisCo: Discovering Common Affordance from Large Models for Actionable Part Perception
WACV 2025
·
Youpeng Wen
DBLP profile ↗
ORCID search ↗
DreamFit: Garment-Centric Human Generation via a Lightweight Anything-Dressing Encoder
AAAI 2025
·
Ente Lin
DBLP profile ↗
ORCID search ↗
EMOVA: Empowering Language Models to See, Hear and Speak with Vivid Emotions
CVPR 2025
·
Kai Chen
DBLP profile ↗
ORCID search ↗
FireEdit: Fine-grained Instruction-based Image Editing via Region-aware Vision Language Model
CVPR 2025
·
Jun Zhou
DBLP profile ↗
ORCID search ↗
GDrag: Towards General-Purpose Interactive Editing with Anti-ambiguity Point Diffusion
ICLR 2025
·
Xiaojian Lin
DBLP profile ↗
ORCID search ↗
Getting More Juice Out of Your Data: Hard Pair Refinement Enhances Visual-Language Models Without Extra Data
NAACL 2025
·
Haonan Wang
DBLP profile ↗
ORCID search ↗
HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models
CVPR 2025
·
Runhui Huang
DBLP profile ↗
ORCID search ↗
LaVieID: Local Autoregressive Diffusion Transformers for Identity-Preserving Video Creation
ACM MM 2025
·
Wenhui Song
DBLP profile ↗
ORCID search ↗
MUSE: Mamba Is Efficient Multi-scale Learner for Text-video Retrieval
AAAI 2025
·
Haoran Tang
DBLP profile ↗
ORCID search ↗
MineAnyBuild: Benchmarking Spatial Planning for Open-world AI Agents
NeurIPS 2025
·
Ziming Wei
DBLP profile ↗
ORCID search ↗
ORMind: A Cognitive-Inspired End-to-End Reasoning Framework for Operations Research
ACL 2025
·
Zhiyuan Wang
DBLP profile ↗
ORCID search ↗
OmniGen: Unified Multimodal Sensor Generation for Autonomous Driving
ACM MM 2025
·
Tao Tang
DBLP profile ↗
ORCID search ↗
OptiBench Meets ReSocratic: Measure and Improve LLMs for Optimization Modeling
ICLR 2025
·
Zhicheng Yang
DBLP profile ↗
ORCID search ↗
PT-T2I/V: An Efficient Proxy-Tokenized Diffusion Transformer for Text-to-Image/Video-Task
ICLR 2025
·
Jing Wang
DBLP profile ↗
ORCID search ↗
PhyBlock: A Progressive Benchmark for Physical Understanding and Planning via 3D Block Assembly
NeurIPS 2025
·
Liang Ma
DBLP profile ↗
ORCID search ↗
Realistic and Efficient Face Swapping: A Unified Approach with Diffusion Models
WACV 2025
·
Sanoojan Baliah
DBLP profile ↗
ORCID search ↗
RoBridge: A Hierarchical Architecture Bridging Cognition and Execution for General Robotic Manipulation
ICCV 2025
·
Kaidong Zhang
DBLP profile ↗
ORCID search ↗
RoboPearls: Editable Video Simulation for Robot Manipulation
ICCV 2025
·
Tang Tao
DBLP profile ↗
ORCID search ↗
RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving
ICCV 2025
·
Zhijian Huang
DBLP profile ↗
ORCID search ↗
RoomTour3D: Geometry-Aware Video-Instruction Tuning for Embodied Navigation
CVPR 2025
·
Mingfei Han
DBLP profile ↗
ORCID search ↗
S2-Track: A Simple yet Strong Approach for End-to-End 3D Multi-Object Tracking
ICML 2025
·
Tao Tang
DBLP profile ↗
ORCID search ↗
SPC: Evolving Self-Play Critic via Adversarial Games for LLM Reasoning
NeurIPS 2025
·
Jiaqi Chen
DBLP profile ↗
ORCID search ↗
SeePhys: Does Seeing Help Thinking? - Benchmarking Vision-Based Physics Reasoning
NeurIPS 2025
·
Kun Xiang
DBLP profile ↗
ORCID search ↗
Sitcom-Crafter: A Plot-Driven Human Motion Generation System in 3D Scenes
ICLR 2025
·
Jianqi Chen
DBLP profile ↗
ORCID search ↗
Structured Preference Optimization for Vision-Language Long-Horizon Task Planning
EMNLP 2025
·
Xiwen Liang
DBLP profile ↗
ORCID search ↗
UniGS: Unified Language-Image-3D Pretraining with Gaussian Splatting
ICLR 2025
·
Haoyuan Li
DBLP profile ↗
ORCID search ↗
WISA: World simulator assistant for physics-aware text-to-video generation
NeurIPS 2025
·
Jing Wang
DBLP profile ↗
ORCID search ↗
3D Visibility-Aware Generalizable Neural Radiance Fields for Interacting Hands
AAAI 2024
·
Xuan Huang
DBLP profile ↗
ORCID search ↗
APTNESS: Incorporating Appraisal Theory and Emotion Support Strategies for Empathetic Response Generation
CIKM 2024
·
Yuxuan Hu
DBLP profile ↗
ORCID search ↗
ATG: Benchmarking Automated Theorem Generation for Generative Language Models
NAACL 2024
·
Xiaohan Lin
DBLP profile ↗
ORCID search ↗
AlignMiF: Geometry-Aligned Multimodal Implicit Field for LiDAR-Camera Joint Synthesis
CVPR 2024
·
Tang Tao
DBLP profile ↗
ORCID search ↗
AlignedCoT: Prompting Large Language Models via Native-Speaking Demonstrations
EMNLP 2024
·
Zhicheng Yang
DBLP profile ↗
ORCID search ↗
CLOMO: Counterfactual Logical Modification with Large Language Models
ACL 2024
·
Yinya Huang
DBLP profile ↗
ORCID search ↗
Contrastive Learning with Counterfactual Explanations for Radiology Report Generation
ECCV 2024
·
Mingjie Li
DBLP profile ↗
ORCID search ↗
CorNav: Autonomous Agent with Self-Corrected Planning for Zero-Shot Vision-and-Language Navigation
ACL 2024
·
Xiwen Liang
DBLP profile ↗
ORCID search ↗
DQ-LoRe: Dual Queries with Low Rank Approximation Re-ranking for In-Context Learning
ICLR 2024
·
Jing Xiong
DBLP profile ↗
ORCID search ↗
DetCLIPv3: Towards Versatile Generative Open-Vocabulary Object Detection
CVPR 2024
·
Lewei Yao
DBLP profile ↗
ORCID search ↗
DreamVTON: Customizing 3D Virtual Try-on with Personalized Diffusion Models
ACM MM 2024
·
Zhenyu Xie
DBLP profile ↗
ORCID search ↗
FVEL: Interactive Formal Verification Environment with Large Language Models via Theorem Proving
NeurIPS 2024
·
Xiaohan Lin
DBLP profile ↗
ORCID search ↗
GarmentAligner: Text-to-Garment Generation via Retrieval-Augmented Multi-level Corrections
ECCV 2024
·
Shiyue Zhang
DBLP profile ↗
ORCID search ↗
Holistic Autonomous Driving Understanding by Bird'View Injected Multi-Modal Large Models
CVPR 2024
·
Xinpeng Ding
DBLP profile ↗
ORCID search ↗
HumanRefiner: Benchmarking Abnormal Human Generation and Refining with Coarse-to-Fine Pose-Reversible Guidance
ECCV 2024
·
Guian Fang
DBLP profile ↗
ORCID search ↗
Ins-DetCLIP: Aligning Detection Model to Follow Human-Language Instruction
ICLR 2024
·
Renjie Pi
DBLP profile ↗
ORCID search ↗
LEGO-Prover: Neural Theorem Proving with Growing Libraries
ICLR 2024
·
Haiming Wang
DBLP profile ↗
ORCID search ↗
LayerDiff: Exploring Text-Guided Multi-layered Composable Image Synthesis via Layer-Collaborative Diffusion Model
ECCV 2024
·
Runhui Huang
DBLP profile ↗
ORCID search ↗
Learning Interaction-aware 3D Gaussian Splatting for One-shot Hand Avatars
NeurIPS 2024
·
Xuan Huang
DBLP profile ↗
ORCID search ↗
LiDAR-NeRF: Novel LiDAR View Synthesis via Neural Radiance Fields
ACM MM 2024
·
Tang Tao
DBLP profile ↗
ORCID search ↗
MLP Can Be a Good Transformer Learner
CVPR 2024
·
Sihao Lin
DBLP profile ↗
ORCID search ↗
MUSTARD: Mastering Uniform Synthesis of Theorem and Proof Data
ICLR 2024
·
Yinya Huang
DBLP profile ↗
ORCID search ↗
Making Large Language Models Better Planners with Reasoning-Decision Alignment
ECCV 2024
·
Zhijian Huang
DBLP profile ↗
ORCID search ↗
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
ACL 2024
·
Jiaqi Chen
DBLP profile ↗
ORCID search ↗
Monocular 3D Hand Mesh Recovery via Dual Noise Estimation
AAAI 2024
·
Hanhui Li
DBLP profile ↗
ORCID search ↗
PIVOT-R: Primitive-Driven Waypoint-Aware World Model for Robotic Manipulation
NeurIPS 2024
·
Kaidong Zhang
DBLP profile ↗
ORCID search ↗
PTUS: Photo-Realistic Talking Upper-Body Synthesis via 3D-Aware Motion Decomposition Warping
AAAI 2024
·
Luoyang Lin
DBLP profile ↗
ORCID search ↗
Proving Theorems Recursively
NeurIPS 2024
·
Haiming Wang
DBLP profile ↗
ORCID search ↗
RAP: Efficient Text-Video Retrieval with Sparse-and-Correlated Adapter
ACL 2024
·
Meng Cao
DBLP profile ↗
ORCID search ↗
Towards Detailed Text-to-Motion Synthesis via Basic-to-Advanced Hierarchical Diffusion Model
AAAI 2024
·
Zhenyu Xie
DBLP profile ↗
ORCID search ↗
VidMan: Exploiting Implicit Dynamics from Video Diffusion Model for Effective Robot Manipulation
NeurIPS 2024
·
Youpeng Wen
DBLP profile ↗
ORCID search ↗
VisDiaHalBench: A Visual Dialogue Benchmark For Diagnosing Hallucination in Large Vision-Language Models
ACL 2024
·
Qingxing Cao
DBLP profile ↗
ORCID search ↗
Web2Code: A Large-scale Webpage-to-Code Dataset and Evaluation Framework for Multimodal LLMs
NeurIPS 2024
·
Sukmin Yun
DBLP profile ↗
ORCID search ↗