P
PaperPicks
Conferences
Zitong Yu
35 papers at tracked venues · 24 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×8
ACM MM
×8
CVPR
×4
ECCV
×4
MICCAI
×3
ICCV
×2
ACL
×1
BMVC
×1
ECAI
×1
EMNLP
×1
ICLR
×1
IJCAI
×1
Frequent coauthors
Qilang Ye
DBLP profile ↗
ORCID search ↗
×3
Jingyi Yang
DBLP profile ↗
ORCID search ↗
×3
Yijie Zhu
DBLP profile ↗
ORCID search ↗
×2
Xun Lin
DBLP profile ↗
ORCID search ↗
×2
Hongyang Wang
DBLP profile ↗
ORCID search ↗
×1
Yingjie Ma
DBLP profile ↗
ORCID search ↗
×1
Jiayu Zhang
DBLP profile ↗
ORCID search ↗
×1
Nuoer Long
DBLP profile ↗
ORCID search ↗
×1
Xiaole Xian
DBLP profile ↗
ORCID search ↗
×1
Xinqi Su
DBLP profile ↗
ORCID search ↗
×1
Chao Hao
DBLP profile ↗
ORCID search ↗
×1
Zenghao Niu
DBLP profile ↗
ORCID search ↗
×1
Papers
FaceShield: Explainable Face Anti-Spoofing with Multimodal Large Language Models
AAAI 2026
·
Hongyang Wang
DBLP profile ↗
ORCID search ↗
H-GAR: A Hierarchical Interaction Framework via Goal-Driven Observation-Action Refinement for Robotic Manipulation
AAAI 2026
·
Yijie Zhu
DBLP profile ↗
ORCID search ↗
PA-FAS: Towards Interpretable and Generalizable Multimodal Face Anti-Spoofing via Path-Augmented Reinforcement Learning
AAAI 2026
·
Yingjie Ma
DBLP profile ↗
ORCID search ↗
Retrieving to Recover: Towards Incomplete Audio-Visual Question Answering via Semantic-consistent Purification
ACL 2026
·
Jiayu Zhang
DBLP profile ↗
ORCID search ↗
SUGAR: Learning Skeleton Representation with Visual-Motion Knowledge for Action Recognition
AAAI 2026
·
Qilang Ye
DBLP profile ↗
ORCID search ↗
When Eyes and Ears Disagree: Can MLLMs Discern Audio-Visual Confusion?
AAAI 2026
·
Qilang Ye
DBLP profile ↗
ORCID search ↗
BiMSRec: A Progressive Image Reconstruction Framework for Medical Image Fusion Guided by Multi-scale Deformation Fields
MICCAI 2025
·
Nuoer Long
DBLP profile ↗
ORCID search ↗
CA-Edit: Causality-Aware Condition Adapter for High-Fidelity Local Facial Attribute Editing
AAAI 2025
·
Xiaole Xian
DBLP profile ↗
ORCID search ↗
DADM: Dual Alignment of Domain and Modality for Face Anti-Spoofing
ICCV 2025
·
Jingyi Yang
DBLP profile ↗
ORCID search ↗
Dynamic Analysis and Adaptive Discriminator for Fake News Detection
ACM MM 2025
·
Xinqi Su
DBLP profile ↗
ORCID search ↗
Dynamic Collaboration of Multi-Language Models based on Minimal Complete Semantic Units
EMNLP 2025
·
Chao Hao
DBLP profile ↗
ORCID search ↗
EmoSym: A Symbiotic Framework for Unified Emotional Understanding and Generation via Latent Reasoning
ACM MM 2025
·
Yijie Zhu
DBLP profile ↗
ORCID search ↗
Enhancing Adversarial Transferability by Balancing Exploration and Exploitation with Gradient-Guided Sampling
ICCV 2025
·
Zenghao Niu
DBLP profile ↗
ORCID search ↗
FEALLM: Advancing Facial Emotion Analysis in Multimodal Large Language Models with Emotional Synergy and Reasoning
ACM MM 2025
·
Zhuozhao Hu
DBLP profile ↗
ORCID search ↗
FSBench: A Figure Skating Benchmark for Advancing Artistic Sports Understanding
CVPR 2025
·
Rong Gao
DBLP profile ↗
ORCID search ↗
Few-Shot Audio-Visual Class-Incremental Learning with Temporal Prompting and Regularization
AAAI 2025
·
Yawen Cui
DBLP profile ↗
ORCID search ↗
GM-DF: Generalized Multi-Scenario Deepfake Detection
ACM MM 2025
·
Yingxin Lai
DBLP profile ↗
ORCID search ↗
Kronecker Mask and Interpretive Prompts are Language-Action Video Learners
ICLR 2025
·
Jingyi Yang
DBLP profile ↗
ORCID search ↗
MSAmba: Exploring Multimodal Sentiment Analysis with State Space Models
AAAI 2025
·
Xilin He
DBLP profile ↗
ORCID search ↗
MedIQA: A Scalable Foundation Model for Prompt-Driven Medical Image Quality Assessment
MICCAI 2025
·
Siyi Xun
DBLP profile ↗
ORCID search ↗
MoEdit: On Learning Quantity Perception for Multi-object Image Editing
CVPR 2025
·
Yanfeng Li
DBLP profile ↗
ORCID search ↗
Multimodal Fake News Detection: MFND Dataset and Shallow-Deep Multitask Learning
IJCAI 2025
·
Ye Zhu
DBLP profile ↗
ORCID search ↗
Multiple Appropriate Facial Reaction Generation Based on Multi-View Transformation of Speaker Video
ACM MM 2025
·
Jiajian Huang
DBLP profile ↗
ORCID search ↗
Smooth Online Multiple Appropriate Facial Reaction Generation
ACM MM 2025
·
Weicheng Xie
DBLP profile ↗
ORCID search ↗
TRRG: Towards Truthful Radiology Report Generation With Cross-Modal Disease Clue Enhanced Large Language Models
MICCAI 2025
·
Yuhao Wang
DBLP profile ↗
ORCID search ↗
AUFormer: Vision Transformers Are Parameter-Efficient Facial Action Unit Detectors
ECCV 2024
·
Kaishen Yuan
DBLP profile ↗
ORCID search ↗
CAT: Enhancing Multimodal Large Language Model to Answer Questions in Dynamic Audio-Visual Scenarios
ECCV 2024
·
Qilang Ye
DBLP profile ↗
ORCID search ↗
DiffFAS: Face Anti-spoofing via Generative Diffusion Models
ECCV 2024
·
Xinxu Ge
DBLP profile ↗
ORCID search ↗
Difflare: Removing Image Lens Flare with Latent Diffusion Models
BMVC 2024
·
Tianwen Zhou
DBLP profile ↗
ORCID search ↗
Facial Physiological and Emotional Analysis
ACM MM 2024
·
Zitong Yu
GPT as Psychologist? Preliminary Evaluations for GPT-4V on Visual Affective Computing
CVPR 2024
·
Hao Lu
DBLP profile ↗
ORCID search ↗
Generalized Face Anti-Spoofing via Finer Domain Partition and Disentangling Liveness-Irrelevant Factors
ECAI 2024
·
Jingyi Yang
DBLP profile ↗
ORCID search ↗
HideMIA: Hidden Wavelet Mining for Privacy-Enhancing Medical Image Analysis
ACM MM 2024
·
Xun Lin
DBLP profile ↗
ORCID search ↗
MTaDCS: Moving Trace and Feature Density-Based Confidence Sample Selection Under Label Noise
ECCV 2024
·
Qingzheng Huang
DBLP profile ↗
ORCID search ↗
Suppress and Rebalance: Towards Generalized Multi-Modal Face Anti-Spoofing
CVPR 2024
·
Xun Lin
DBLP profile ↗
ORCID search ↗