P
PaperPicks
Conferences
Siteng Huang
16 papers at tracked venues · 13 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0002-9735-1186 ↗
Homepage ↗
Venues
AAAI
×6
CVPR
×3
ECCV
×2
ACM MM
×1
ICCV
×1
ICLR
×1
ICRA
×1
NeurIPS
×1
Frequent coauthors
Yang Liu
DBLP profile ↗
ORCID search ↗
×2
Yuhang Han
DBLP profile ↗
ORCID search ↗
×1
Xuyang Liu
DBLP profile ↗
ORCID search ↗
×1
Haoyu Zhao
DBLP profile ↗
ORCID search ↗
×1
Yihao Wang
DBLP profile ↗
ORCID search ↗
×1
Chang Zou
DBLP profile ↗
ORCID search ↗
×1
Zhefei Gong
DBLP profile ↗
ORCID search ↗
×1
Han Zhao
DBLP profile ↗
ORCID search ↗
×1
Xinyang Tong
DBLP profile ↗
ORCID search ↗
×1
Biao Gong
DBLP profile ↗
ORCID search ↗
×1
Can Cui
DBLP profile ↗
ORCID search ↗
×1
Shuanghao Bai
DBLP profile ↗
ORCID search ↗
×1
Papers
Filter, Correlate, Compress: Training-Free Token Reduction for MLLM Acceleration
AAAI 2026
·
Yuhang Han
DBLP profile ↗
ORCID search ↗
Global Compression Commander: Plug-and-Play Inference Acceleration for High-Resolution Large Vision-Language Models
AAAI 2026
·
Xuyang Liu
DBLP profile ↗
ORCID search ↗
Towards Affordance-Aware Robotic Dexterous Grasping with Human-like Priors
AAAI 2026
·
Haoyu Zhao
DBLP profile ↗
ORCID search ↗
VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model
AAAI 2026
·
Yihao Wang
DBLP profile ↗
ORCID search ↗
Accelerating Diffusion Transformers with Token-wise Feature Caching
ICLR 2025
·
Chang Zou
DBLP profile ↗
ORCID search ↗
CARP: Visuomotor Policy Learning via Coarse-to-Fine Autoregressive Prediction
ICCV 2025
·
Zhefei Gong
DBLP profile ↗
ORCID search ↗
Cobra: Extending Mamba to Multi-Modal Large Language Model for Efficient Inference
AAAI 2025
·
Han Zhao
DBLP profile ↗
ORCID search ↗
Quart-Online: Latency-Free Multimodal Large Language Model for Quadruped Robot Learning
ICRA 2025
·
Xinyang Tong
DBLP profile ↗
ORCID search ↗
SSR: Enhancing Depth Perception in Vision-Language Models via Rationale-Guided Spatial Reasoning
NeurIPS 2025
·
Yang Liu
DBLP profile ↗
ORCID search ↗
Check, Locate, Rectify: A Training-Free Layout Calibration System for Text- to- Image Generation
CVPR 2024
·
Biao Gong
DBLP profile ↗
ORCID search ↗
Learning Disentangled Identifiers for Action-Customized Text-to-Image Generation
CVPR 2024
·
Siteng Huang
PiTe: Pixel-Temporal Alignment for Large Video-Language Model
ECCV 2024
·
Yang Liu
DBLP profile ↗
ORCID search ↗
ProFD: Prompt-Guided Feature Disentangling for Occluded Person Re-Identification
ACM MM 2024
·
Can Cui
DBLP profile ↗
ORCID search ↗
Prompt-Based Distribution Alignment for Unsupervised Domain Adaptation
AAAI 2024
·
Shuanghao Bai
DBLP profile ↗
ORCID search ↗
QUAR-VLA: Vision-Language-Action Model for Quadruped Robots
ECCV 2024
·
Pengxiang Ding
DBLP profile ↗
ORCID search ↗
Troika: Multi-Path Cross-Modal Traction for Compositional Zero-Shot Learning
CVPR 2024
·
Siteng Huang