P
PaperPicks
Conferences
Yunhang Shen
32 papers at tracked venues · 31 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0002-3970-7519 ↗
Homepage ↗
Venues
AAAI
×8
CVPR
×6
ICML
×5
ACM MM
×4
NeurIPS
×4
ICCV
×2
ICLR
×2
IJCAI
×1
Frequent coauthors
Xudong Li
DBLP profile ↗
ORCID search ↗
×5
Jianghang Lin
DBLP profile ↗
ORCID search ↗
×3
Chaoyou Fu
DBLP profile ↗
ORCID search ↗
×3
Zhen Sun
DBLP profile ↗
ORCID search ↗
×2
Wenxuan Huang
DBLP profile ↗
ORCID search ↗
×2
Zihao He
DBLP profile ↗
ORCID search ↗
×1
Yunshuai Zhou
DBLP profile ↗
ORCID search ↗
×1
Bo Tong
DBLP profile ↗
ORCID search ↗
×1
Xiong Wang
DBLP profile ↗
ORCID search ↗
×1
Yuhui Zeng
DBLP profile ↗
ORCID search ↗
×1
Chenyu Zhou
DBLP profile ↗
ORCID search ↗
×1
Shuyang Liu
DBLP profile ↗
ORCID search ↗
×1
Papers
Robust Pseudo-Labeling via Decoupled Class-Aware Filtering and Dynamic Category Correction
AAAI 2026
·
Jianghang Lin
DBLP profile ↗
ORCID search ↗
BUFF: Bayesian Uncertainty Guided Diffusion Probabilistic Model for Single Image Super-Resolution
AAAI 2025
·
Zihao He
DBLP profile ↗
ORCID search ↗
DS-VLM: Diffusion Supervision Vision Language Model
ICML 2025
·
Zhen Sun
DBLP profile ↗
ORCID search ↗
Dynamic Contrastive Knowledge Distillation for Efficient Image Restoration
AAAI 2025
·
Yunshuai Zhou
DBLP profile ↗
ORCID search ↗
Dynamic-LLaVA: Efficient Multimodal Large Language Models via Dynamic Vision-language Context Sparsification
ICLR 2025
·
Wenxuan Huang
DBLP profile ↗
ORCID search ↗
Feature Denoising Diffusion Model for Blind Image Quality Assessment
AAAI 2025
·
Xudong Li
DBLP profile ↗
ORCID search ↗
Few-Shot Image Quality Assessment via Adaptation of Vision-Language Models
ICCV 2025
·
Xudong Li
DBLP profile ↗
ORCID search ↗
FlashSloth : Lightning Multimodal Large Language Models via Embedded Visual Compression
CVPR 2025
·
Bo Tong
DBLP profile ↗
ORCID search ↗
FlexiReID: Adaptive Mixture of Expert for Multi-Modal Person Re-Identification
ICML 2025
·
Zhen Sun
DBLP profile ↗
ORCID search ↗
Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM
ICML 2025
·
Xiong Wang
DBLP profile ↗
ORCID search ↗
From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors Via LLM-guided Symbolic Reasoning
ICCV 2025
·
Yuhui Zeng
DBLP profile ↗
ORCID search ↗
Learning Interleaved Image-Text Comprehension in Vision-Language Large Models
ICLR 2025
·
Chenyu Zhou
DBLP profile ↗
ORCID search ↗
MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models
NeurIPS 2025
·
Chaoyou Fu
DBLP profile ↗
ORCID search ↗
Probability-Density-aware Semi-supervised Learning
AAAI 2025
·
Shuyang Liu
DBLP profile ↗
ORCID search ↗
Towards Universal Perception through Language-Guided Open-World Object Detection
ACM MM 2025
·
Zihan Wang
DBLP profile ↗
ORCID search ↗
VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction
NeurIPS 2025
·
Chaoyou Fu
DBLP profile ↗
ORCID search ↗
VITA-Audio: Fast Interleaved Audio-Text Token Generation for Efficient Large Speech-Language Model
NeurIPS 2025
·
Zuwei Long
DBLP profile ↗
ORCID search ↗
Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis
CVPR 2025
·
Chaoyou Fu
DBLP profile ↗
ORCID search ↗
Weakly Supervised Semantic Segmentation via Progressive Confidence Region Expansion
CVPR 2025
·
Xiangfeng Xu
DBLP profile ↗
ORCID search ↗
What You Perceive Is What You Conceive: A Cognition-Inspired Framework for Open Vocabulary Image Segmentation
ACM MM 2025
·
Jianghang Lin
DBLP profile ↗
ORCID search ↗
Zooming from Context to Cue: Hierarchical Preference Optimization for Multi-Image MLLMs
NeurIPS 2025
·
Xudong Li
DBLP profile ↗
ORCID search ↗
A General and Efficient Training for Transformer via Token Expansion
CVPR 2024
·
Wenxuan Huang
DBLP profile ↗
ORCID search ↗
Adaptive Feature Selection for No-Reference Image Quality Assessment by Mitigating Semantic Noise Sensitivity
ICML 2024
·
Xudong Li
DBLP profile ↗
ORCID search ↗
Aligning and Prompting Everything All at Once for Universal Visual Perception
CVPR 2024
·
Yunhang Shen
Cantor: Inspiring Multimodal Chain-of-Thought of MLLM
ACM MM 2024
·
Timin Gao
DBLP profile ↗
ORCID search ↗
Integrating Global Context Contrast and Local Sensitivity for Blind Image Quality Assessment
ICML 2024
·
Xudong Li
DBLP profile ↗
ORCID search ↗
Multimodal Inplace Prompt Tuning for Open-set Object Detection
ACM MM 2024
·
Guilin Li
DBLP profile ↗
ORCID search ↗
Rethinking Centered Kernel Alignment in Knowledge Distillation
IJCAI 2024
·
Zikai Zhou
DBLP profile ↗
ORCID search ↗
SPD-DDPM: Denoising Diffusion Probabilistic Models in the Symmetric Positive Definite Space
AAAI 2024
·
Yunchen Li
DBLP profile ↗
ORCID search ↗
Semi-Supervised Blind Image Quality Assessment through Knowledge Distillation and Incremental Learning
AAAI 2024
·
Wensheng Pan
DBLP profile ↗
ORCID search ↗
Solving the Catastrophic Forgetting Problem in Generalized Category Discovery
CVPR 2024
·
Xinzi Cao
DBLP profile ↗
ORCID search ↗
Weakly Supervised Open-Vocabulary Object Detection
AAAI 2024
·
Jianghang Lin
DBLP profile ↗
ORCID search ↗