P
PaperPicks
Conferences
Yun Zheng
11 papers at tracked venues · 9 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×3
CVPR
×2
ECCV
×2
NeurIPS
×2
ICCV
×1
ICLR
×1
Frequent coauthors
Xiaoyi Bao
DBLP profile ↗
ORCID search ↗
×3
Yuxin Guo
DBLP profile ↗
ORCID search ↗
×2
Zhihang Liu
DBLP profile ↗
ORCID search ↗
×2
Mingda Jia
DBLP profile ↗
ORCID search ↗
×2
Hao Tang
DBLP profile ↗
ORCID search ↗
×1
Chen-Wei Xie
DBLP profile ↗
ORCID search ↗
×1
Papers
Aligned Better, Listen Better for Audio-Visual Large Language Models
ICLR 2025
·
Yuxin Guo
DBLP profile ↗
ORCID search ↗
CAPability: A Comprehensive Visual Caption Benchmark for Evaluating Both Correctness and Thoroughness
NeurIPS 2025
·
Zhihang Liu
DBLP profile ↗
ORCID search ↗
ContextHOI: Spatial Context Learning for Human-Object Interaction Detection
AAAI 2025
·
Mingda Jia
DBLP profile ↗
ORCID search ↗
DynImg: Key Frames with Visual Prompts are Good Representation for Multi-Modal Video Understanding
ICCV 2025
·
Xiaoyi Bao
DBLP profile ↗
ORCID search ↗
Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models
CVPR 2025
·
Zhihang Liu
DBLP profile ↗
ORCID search ↗
Orchestrating the Symphony of Prompt Distribution Learning for Human-Object Interaction Detection
AAAI 2025
·
Mingda Jia
DBLP profile ↗
ORCID search ↗
UFO: A Unified Approach to Fine-grained Visual Perception via Open-ended Language Interface
NeurIPS 2025
·
Hao Tang
DBLP profile ↗
ORCID search ↗
CoReS: Orchestrating the Dance of Reasoning and Segmentation
ECCV 2024
·
Xiaoyi Bao
DBLP profile ↗
ORCID search ↗
CrossMAE: Cross-Modality Masked Autoencoders for Region-Aware Audio-Visual Pre-Training
CVPR 2024
·
Yuxin Guo
DBLP profile ↗
ORCID search ↗
FuseTeacher: Modality-Fused Encoders are Strong Vision Supervisors
ECCV 2024
·
Chen-Wei Xie
DBLP profile ↗
ORCID search ↗
Relevant Intrinsic Feature Enhancement Network for Few-Shot Semantic Segmentation
AAAI 2024
·
Xiaoyi Bao
DBLP profile ↗
ORCID search ↗