P
PaperPicks
Conferences
Yuexian Zou
38 papers at tracked venues · 21 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×9
ACL
×7
InterSpeech
×6
EMNLP
×5
CIKM
×2
ICLR
×2
ACM MM
×1
CVPR
×1
ECCV
×1
IJCAI
×1
NAACL
×1
NeurIPS
×1
WSDM
×1
Frequent coauthors
Xianwei Zhuang
DBLP profile ↗
ORCID search ↗
×8
Xuxin Cheng
DBLP profile ↗
ORCID search ↗
×5
Zhihong Zhu
DBLP profile ↗
ORCID search ↗
×4
Zhanpeng Chen
DBLP profile ↗
ORCID search ↗
×3
Yongkang Yin
DBLP profile ↗
ORCID search ↗
×2
Liming Liang
DBLP profile ↗
ORCID search ↗
×2
Yifei Xin
DBLP profile ↗
ORCID search ↗
×2
Wanshi Xu
DBLP profile ↗
ORCID search ↗
×2
Bowen Cao
DBLP profile ↗
ORCID search ↗
×2
Lexiang Tang
DBLP profile ↗
ORCID search ↗
×1
Yuguo Yin
DBLP profile ↗
ORCID search ↗
×1
Yaowei Li
DBLP profile ↗
ORCID search ↗
×1
Papers
Not All Tokens and Heads Are Equally Important: Dual-Level Attention Intervention for Hallucination Mitigation
AAAI 2026
·
Lexiang Tang
DBLP profile ↗
ORCID search ↗
WhisperDiari: A Whisper-Based Speaker Diarization Framework in Token Space Leveraging Semantic and Speaker Information for Better Text Adaptability
AAAI 2026
·
Yongkang Yin
DBLP profile ↗
ORCID search ↗
ATRI: Mitigating Multilingual Audio Text Retrieval Inconsistencies by Reducing Data Distribution Errors
ACL 2025
·
Yuguo Yin
DBLP profile ↗
ORCID search ↗
Advancing General Multimodal Capability of Vision-language Models with Pyramid-descent Visual Position Encoding
ACL 2025
·
Zhanpeng Chen
DBLP profile ↗
ORCID search ↗
FoleyMaster: High-Quality Video-to-Audio Synthesis via MLLM-Augmented Prompt Tuning and Joint Semantic-Temporal Adaptation
InterSpeech 2025
·
Liming Liang
DBLP profile ↗
ORCID search ↗
Image Conductor: Precision Control for Interactive Video Synthesis
AAAI 2025
·
Yaowei Li
DBLP profile ↗
ORCID search ↗
SpeechSEC: A Unified Multi-Task Framework for Speech Synthesis, Editing, and Continuation
InterSpeech 2025
·
Liming Liang
DBLP profile ↗
ORCID search ↗
UniCoTT: A Unified Framework for Structural Chain-of-Thought Distillation
ICLR 2025
·
Xianwei Zhuang
DBLP profile ↗
ORCID search ↗
VASparse: Towards Efficient Visual Hallucination Mitigation via Visual-Aware Token Sparsification
CVPR 2025
·
Xianwei Zhuang
DBLP profile ↗
ORCID search ↗
AFL-Net: Integrating Audio, Facial, and Lip Modalities with a Two-step Cross-attention for Robust Speaker Diarization in the Wild
InterSpeech 2024
·
Yongkang Yin
DBLP profile ↗
ORCID search ↗
Aligner²: Enhancing Joint Multiple Intent Detection and Slot Filling via Adjustive and Forced Cross-Task Alignment
AAAI 2024
·
Zhihong Zhu
DBLP profile ↗
ORCID search ↗
Audio-text Retrieval with Transformer-based Hierarchical Alignment and Disentangled Cross-modal Representation
InterSpeech 2024
·
Yifei Xin
DBLP profile ↗
ORCID search ↗
AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head
AAAI 2024
·
Rongjie Huang
DBLP profile ↗
ORCID search ↗
Code-Switching Can be Better Aligners: Advancing Cross-Lingual SLU through Representation-Level and Prediction-Level Alignment
ACL 2024
·
Zhihong Zhu
DBLP profile ↗
ORCID search ↗
Cyclical Contrastive Learning Based on Geodesic for Zero-shot Cross-lingual Spoken Language Understanding
ACL 2024
·
Xuxin Cheng
DBLP profile ↗
ORCID search ↗
Dance with Labels: Dual-Heterogeneous Label Graph Interaction for Multi-intent Spoken Language Understanding
WSDM 2024
·
Zhihong Zhu
DBLP profile ↗
ORCID search ↗
DiffATR: Diffusion-based Generative Modeling for Audio-Text Retrieval
InterSpeech 2024
·
Yifei Xin
DBLP profile ↗
ORCID search ↗
Dual-oriented Disentangled Network with Counterfactual Intervention for Multimodal Intent Detection
EMNLP 2024
·
Zhanpeng Chen
DBLP profile ↗
ORCID search ↗
Embracing Language Inclusivity and Diversity in CLIP through Continual Language Learning
AAAI 2024
·
Bang Yang
DBLP profile ↗
ORCID search ↗
Exploiting Auxiliary Caption for Video Grounding
AAAI 2024
·
Hongxiang Li
DBLP profile ↗
ORCID search ↗
GPA: Global and Prototype Alignment for Audio-Text Retrieval
InterSpeech 2024
·
Yuxin Xie
DBLP profile ↗
ORCID search ↗
Game on Tree: Visual Hallucination Mitigation via Coarse-to-Fine View Tree and Game Theory
EMNLP 2024
·
Xianwei Zhuang
DBLP profile ↗
ORCID search ↗
Generating More Audios for End-to-End Spoken Language Understanding
IJCAI 2024
·
Xuxin Cheng
DBLP profile ↗
ORCID search ↗
KDProR: A Knowledge-Decoupling Probabilistic Framework for Video-Text Retrieval
ECCV 2024
·
Xianwei Zhuang
DBLP profile ↗
ORCID search ↗
Learning to Match Representations is Better for End-to-End Task-Oriented Dialog System
EMNLP 2024
·
Wanshi Xu
DBLP profile ↗
ORCID search ↗
MaCSC: Towards Multimodal-augmented Pre-trained Language Models via Conceptual Prototypes and Self-balancing Calibration
NAACL 2024
·
Xianwei Zhuang
DBLP profile ↗
ORCID search ↗
MoE-SLU: Towards ASR-Robust Spoken Language Understanding via Mixture-of-Experts
ACL 2024
·
Xuxin Cheng
DBLP profile ↗
ORCID search ↗
On the Worst Prompt Performance of Large Language Models
NeurIPS 2024
·
Bowen Cao
DBLP profile ↗
ORCID search ↗
PCAD: Towards ASR-Robust Spoken Language Understanding via Prototype Calibration and Asymmetric Decoupling
ACL 2024
·
Xianwei Zhuang
DBLP profile ↗
ORCID search ↗
Relevance Is a Guiding Light: Relevance-aware Adaptive Learning for End-to-end Task-oriented Dialogue System
EMNLP 2024
·
Zhanpeng Chen
DBLP profile ↗
ORCID search ↗
Retrieval is Accurate Generation
ICLR 2024
·
Bowen Cao
DBLP profile ↗
ORCID search ↗
Robust Heterophily Graph Learning via Uniformity Augmentation
CIKM 2024
·
Xusheng Yang
DBLP profile ↗
ORCID search ↗
SaLa: Scenario-aware Label Graph Interaction for Multi-intent Spoken Language Understanding
CIKM 2024
·
Zhihong Zhu
DBLP profile ↗
ORCID search ↗
Soul-Mix: Enhancing Multimodal Machine Translation with Manifold Mixup
ACL 2024
·
Xuxin Cheng
DBLP profile ↗
ORCID search ↗
Towards Explainable Joint Models via Information Theory for Multiple Intent Detection and Slot Filling
AAAI 2024
·
Xianwei Zhuang
DBLP profile ↗
ORCID search ↗
Towards Multi-Intent Spoken Language Understanding via Hierarchical Attention and Optimal Transport
AAAI 2024
·
Xuxin Cheng
DBLP profile ↗
ORCID search ↗
Towards Multimodal-augmented Pre-trained Language Models via Self-balanced Expectation-Maximization Iteration
ACM MM 2024
·
Xianwei Zhuang
DBLP profile ↗
ORCID search ↗
What are the Generator Preferences for End-to-end Task-Oriented Dialog System?
EMNLP 2024
·
Wanshi Xu
DBLP profile ↗
ORCID search ↗